论文

用于手写 UML 到 PlantUML 生成的形式主义感知奖励循环

A Formalism-Aware Reward Loop for Handwritten UML-to-PlantUML Generation

模型训练奖励建模与过程监督

摘要

手写的 UML 草图在早期软件设计中很常见,但将它们转变为结构化、可分析的建模制品仍然需要手动重建。视觉语言模型可以从图表图像生成 PlantUML,但基于提示的使用将其视为图像到文本的生成,而不是结构化模型的生成。我们研究形式主义感知奖励:来自可分析模型表示而不是表面文本的反馈信号。在一个工作示例中,我们使用受监督的 微调 和随后的组相对策略优化,采用视觉语言模型来手写 UML 到 PlantUML 生成。生成的 PlantUML 与目标表示进行比较,使用 XMI 作为类图,使用控制流图作为活动图。新的结果表明,与未调整的开放模型和一个专有基线相比,经过调整的模型提高了可编译性和转换质量,同时在类图上与更强大的专有基线保持竞争力。奖励引导阶段的额外好处在当前保留的集合上仍然开放。错误分析和度量有效性结果表明,仅部分捕获了建模可接受性,从而激发了将模型分析与人类判断相结合的奖励和评估。