论文

一张图,每一张画布:通过Agentic管道进行可编辑流程图重新布局

One Figure, Every Canvas: Editable Flowchart Relayout via Agentic Pipeline

摘要

ML 论文中的管道图必须在许多画布上重新利用,包括论文专栏、16:9 幻灯片、肖像海报、1:1 社交预告片、9:16 手机预览。每种格式在同一计算图上施加不同的纵横比,其中任何默默断开的连接都会歪曲该方法。我们将纵横比自适应流程图重新布局制定为一项独特的任务:给定光栅流程图和目标比率,产生结构忠实、无幻觉、可编辑的布局。现有方法的失败特征是:图像到图像模型拉伸块并拒绝极端比例,文本到图像Agentic系统产生幻觉内容,解析然后渲染系统错误路由边缘。我们提出将Agentic管道分解为解析、样式和布局阶段,每个阶段将一个主智能体与一个批评家配对,该批评家将确定性约束检查与VLM视觉反馈相结合,以便显式检查连接性并防止被悄悄破坏。输出是draw.io-可编辑的mxGraph XML。在由 Gemini 3.1 Pro 评估并根据人类判断进行验证的 100 个流程图、五个长宽比的策划基准上,我们的方法达到了 68.6% 的内容保真度,而之前的工作为 11.2-41.4%。项目页面:https://onefigureeverycanvas.vercel.app/

一张图,每一张画布:通过Agentic管道进行可编辑流程图重新布局的原论文方法或结果图
图 1:纵横比自适应流程图布局。给定一个固定比例(左)的单个流程图,我们的方法会以任意纵横比(右)生成保留结构的布局:手机、平板电脑、社交媒体、幻灯片和横幅。三个不同的源图(从上到下)展示了架构图、实验管道和流程的通用性。输出不是重新渲染的图像,而是draw.io-可编辑的XML,准备进一步手动细化。