论文
AuditCoder:用于可审计代码生成和有限修复的责任保留任务图
AuditCoder: Responsibility-Preserving Task Graphs for Auditable Code Generation and Bounded Repair
摘要
代码生成器返回程序,但通常不保留将故障与生成受影响代码的决策联系起来或界定合理修复所需的构造记录。我们提出了 AuditCoder,它将程序和可审计的构造跟踪视为联合输出。在代码生成之前,合同注释的任务图会分配稳定的责任身份,这些身份仍然附加到每个承诺、其拥有的实现、出处、验证证据和干预历史记录。当验证失败时,保守定位器将异构证据映射到节点或依赖分支(或放弃),并且有界修复仅重新生成该区域,同时重用冻结的补集。在 APPS 上,\method{} 达到 $82.5$--$83.0\%$ \texttt{pass@1},弥补了未修复的图分解造成的大部分损失,但落后 AgentCoder $7.5$--$8.5$ 点。在 ClassEval 上,它达到 $75.0$--$82.0\%$,优于 CoT + 重试,同时仍低于 AgentCoder。对 200 个 APPS 记录进行单独审计,得出 0.9725的任务宏决策——代码跟踪覆盖率;定位器针对 60 次故障中的 26 次识别出有证据支持的节点或分支,其中 17 次局部修复通过。对于具有稳定、本地可测试边界的任务,图不仅充当分解结构,而且充当用于验证和修复的持久索引。