论文

教智能体逐部件绘制草图

Teaching an Agent to Sketch One Part at a Time

模型训练强化学习Agentic RL

摘要

我们开发了一种逐部件生成矢量草图的方法。为此,我们在监督微调之后,采用一种新颖的多轮过程奖励强化学习来训练基于多模态语言模型的智能体。该方法依托一个名为ControlSketch-Part的新数据集才得以实现,其中包含丰富的草图部件级标注;这些标注通过一种新颖且通用的自动标注流水线获得,该流水线将矢量草图分割为语义部件,并通过结构化的多阶段标注过程将路径分配给部件。结果表明,引入结构化的部件级数据并在过程中向智能体提供视觉反馈,可实现可解释、可控且可局部编辑的文本到矢量草图生成。

教智能体逐部件绘制草图:论文配图
图 1:使用我们的 VLM 代理渐进式矢量草图生成。通过 SFT + RL 训练对我们的新数据集进行训练,我们的代理根据文本指令和不断变化的画布逐部分生成草图。它可以生成多样化、结构合理的草图,并支持通过任意笔画删除和替换进行本地化编辑。