论文

TraceFix:用TLA+反例修复智能体协调协议

TraceFix: Repairing Agent Coordination Protocols with TLA+ Counterexamples

智能体系统Agent 动作执行与治理Agent Harness

摘要

我们推出了 TraceFix,这是一种用于大语言模型 (LLM) 多代理协调的验证优先管道。代理根据任务描述将协议拓扑合成为结构化中间表示 (IR),生成 PlusCal 协调逻辑,并使用来自 TLA+ 模型检查器 (TLC) 的反例迭代修复协议,直到验证成功。经过验证的流程主体被编译为每个代理系统提示,并在拒绝拓扑外协调操作的运行时监视器下执行。在涵盖16个场景族的48个任务上,所有任务均达到全面的TLC验证; 62.5% 通过了第一次尝试,并且没有一个需要超过四次修复迭代。状态空间跨越六个数量级,但每个任务的验证都在 60 秒内完成。 3,456 次运行的运行时比较表明,拓扑监控的执行实现了最高的任务完成率(平均 89.4%,完整度 81.5%),并且当模型功能降低时,使用经过验证的协议的运行时降级率大约是仅提示和仅聊天基线的一半。固定运行时间下的配对消融表明,经过 TLC 验证的协议将死锁/活锁 (DL/LL) 从 31.1% 减少到 14.1%,其中在故障注入下分离最大。

TraceFix:用TLA+反例修复智能体协调协议:论文配图
图 1.TraceFix 管道概述。在设计时(阶段 1-4),编排代理综合协议拓扑 IR,生成 PlusCal 协调逻辑,并使用 TLC 反例迭代修复协议,直到验证成功。在运行时(第 5-6 阶段),经过验证的流程主体被编译为每个代理提示,并在拒绝协议外协调操作的拓扑监视器下执行。