论文

智能体什么时候可以停止?使用工具的证据携带终止 LLM

When May an Agent Stop? Evidence-Carrying Termination for Tool-Using LLMs

智能体系统Agent 动作执行与治理

摘要

使用工具的代理必须决定何时停止。现有系统已经控制终端成功、验证执行跟踪或强制执行运行时策略,但没有在跨受控终端故障的完整边界上测试这种特定的接收、范围和封闭重放设计。我们实例化并评估携带证据的终止(ECT):仅当键入的证书将每个所需的答案声明与有效的范围内跟踪证据绑定并且确定性重播重建声明的值时,代理才可以返回 COMPLETE。一项锁定的静态研究跨越了 6 个工具使用系列中的 48 个完全综合的任务,具有干净的执行和 8 个错误。 ECT 产生 0/288 不安全完成,而检查的终止批评核心为 252/288(差异 -87.50 pp,95% 任务集群间隔 [-87.50,-87.50] pp)。然后,一项新鲜的、预先指定的和冻结的 576 条轨迹研究将 ECT 与批评者核心、其忠实控制器和全轨迹 LLM 批评者进行比较。在 22 个主要保留任务集群上,ECT 产生的无支持过早终止率为 0/66,而控制器为 40/66(差异 -60.61 pp,95% 间隔 [-78.79,-40.91] pp),而受支持的完成率为 97/132 与 92/132(差异 3.79 pp,间隔 [0.00, 9.09] pp),满足-10点的非劣效性界限。 ECT 在 18/66 条轨迹中成功回收,其中 17 条随后在支持下完成;所有三个闭环门均已通过。 ECT 证明记录跟踪中声明的假设的支持,而不是外部事实、安全性或一致性。