论文
TRACE:可审计智能体承诺的操作性推理模式
TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments
摘要
本文定义TRACE(类型化推理与承诺证据):一个用于记录推理轨迹的类型化、版本化模式;一个据此写记录的参考流程;以及一条操作纪律——没有记录就不做持久状态变更。论文分三层论证推理不在语言模型中:自回归机制原生计算关联;思维链与强化学习继承其局限;从苏格拉底程序到Pearl之梯的推理理论形式构造并未作为机制存在。该模式以字段与测试回应这种缺席:TraceRecord及其因果特化、八阶段参考写入器、门限优先的度量机制、TRACE-Bench协议、以及消费者——记忆准入、计划门控、时序懊悔与裁决复用——其更可审计的决策是记录的度量。记录—消费者契约陈述记录保证什么、消费者必须回报什么,使该模式成为操作接口而非被动文档。正文运行两个 worked 示例:一个从句子追踪到类型化裁决的钢琴课论证——分离关联、干预与处方;一个洪水搜救小插曲——预测性世界模型报告其自身支撑分与分布外分相矛盾的自信计划成功,于是记录推迟承诺、请求有界观察、以仅追加方式修订并放行另一分支。该小插曲为说明性而非实证;闭环评估留待后续工作,故贡献是模式及其契约,而非表现主张。附录承载完整模式、写入器算法与成本模型、临床与政策示例、基准协议、收敛度量与使用场景。
