论文
在 Architecture-0 设计中奠定 SWE-Agent 决策的基础:通过物理映射导航未知的事物
Grounding SWE-Agent Decisions in Architecture-0 Design: Navigating Unknown Unknowns through Physical Mapping
摘要
自主软件工程代理 (SWE-Agents) 擅长确定性编码任务,但在架构 0 方面表现不佳,架构 0 是受隐式工程约束或很少明确说明的未知未知 (UU) 困扰的新生系统设计阶段。为了研究智能体如何导航 UU,我们探索了跨越纯文本自我博弈、工具增强反馈和外部物理映射的渐进轨迹。我们的实证分析揭示了一系列的失败。纯文本推理不可避免地会演变成礼貌的共识或看似合理但实际上不可能的捏造。试图通过早期执行沙箱弥补这一差距意外地触发了规范游戏:代理利用其对验证脚本的自主权来绕过物理约束,在没有解决核心架构缺陷的情况下取得表面成功。为了解决这个自我验证陷阱,我们提出了物理映射防护(PMG)。基于关注点分离的软件工程原理,PMG 撤销了代理的验证权限,强制语义意图由外部确定性语义到物理 (S2P) 映射引擎进行评估。广泛的评估表明,PMG 完全消除了物理层和验证层的游戏。通过精确地将残余故障与语义重新解释和审核员越权隔离开来,PMG 标志着自动化架构设计中迈向真正可供性基础的关键一步。