论文

TRACE:可审计智能体承诺的操作性推理模式

TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments

智能体系统上下文与知识记忆Agent 动作执行与治理Agent记忆

摘要

本文定义TRACE(类型化推理与承诺证据):一个用于记录推理轨迹的类型化、版本化模式;一个据此写记录的参考流程;以及一条操作纪律——没有记录就不做持久状态变更。论文分三层论证推理不在语言模型中:自回归机制原生计算关联;思维链与强化学习继承其局限;从苏格拉底程序到Pearl之梯的推理理论形式构造并未作为机制存在。该模式以字段与测试回应这种缺席:TraceRecord及其因果特化、八阶段参考写入器、门限优先的度量机制、TRACE-Bench协议、以及消费者——记忆准入、计划门控、时序懊悔与裁决复用——其更可审计的决策是记录的度量。记录—消费者契约陈述记录保证什么、消费者必须回报什么,使该模式成为操作接口而非被动文档。正文运行两个 worked 示例:一个从句子追踪到类型化裁决的钢琴课论证——分离关联、干预与处方;一个洪水搜救小插曲——预测性世界模型报告其自身支撑分与分布外分相矛盾的自信计划成功,于是记录推迟承诺、请求有界观察、以仅追加方式修订并放行另一分支。该小插曲为说明性而非实证;闭环评估留待后续工作,故贡献是模式及其契约,而非表现主张。附录承载完整模式、写入器算法与成本模型、临床与政策示例、基准协议、收敛度量与使用场景。

TRACE:可审计智能体承诺的操作性推理模式:论文配图
图 3:小插图的洪水搜救设置。单个任务控制器在命令计算机上运行任务状态、规划器、预测世界模型、TRACE 门和动作调度器;勘测无人机提供观测结果;救援船执行授权派遣;人类事件指挥官批准高风险行动。 TRACE 既不驾驶无人机,也不驾驶船只:它在门口审核预测是否可以授权不可逆转的调度。场景是说明性的,后果是模拟的。该场景是人工智能生成的插图。