论文
Agent Mesh:非幂等智能体委托的可靠性原语——身份充分性与证据充分性
Agent Mesh: Reliability Primitives for Non-Idempotent Agent Delegation - Identity Adequacy and Evidence Adequacy
摘要
自主智能体越来越多地在编排器(orchestrator)的重试、恢复和预算管理下执行有边界的软件任务。这类编排器所诉诸的机制是服务网格的那一套:重试、超时和错误率熔断。我们报告了对一个生产级agentic软件交付平台的故障研究,涉及81次运行中的147个编号事故,每个事故都有测量的成本,且多数情况带有可复现故障的变更证明(mutation proof)。这些原语所依赖的三个假设在实践中全部被违反,我们量化了后果:由五十四次连续成功的工具调用构成的循环,任何错误率熔断器都无法察觉;一个按构造恒定的进度信号,保证在第三轮修复时产生误熔断,使一次运行从六分之六组件完好跌至三;一次委托的六次调用中累积了二十一个事件,使一个正确且幂等的组件也无法获胜;一次被错误路由的故障让五个组件为两组件的故障被唤醒,留下三个旁观者回退了本已正常工作的代码;还有十二起强制执行层阻止正确工作的事故,其中最昂贵的一起耗掉107个智能体轮次且零写入被接受。我们发现一个贯穿性成因及其对偶。身份充分性:在五个独立子系统中,无法起区分作用的身份导致了自信的错误答案,其中两个是独立推导出这一纠正规则的。证据充分性:可靠性决策只能基于这样的证据——能够变动、可归因于其所测量的对象、且在相同条件下是确定的。基于这些发现,我们推导出七项可靠性原语,其强制执行单元是委托而非消息,并指定了该研究所激发但本身并不构成的受控评估。