论文

当只有最终文本幸存时:多代理归因的隐式执行跟踪

When Only the Final Text Survives: Implicit Execution Tracing for Multi-Agent Attribution

模型推理解码与生成控制

摘要

当多代理系统产生不正确或有害的答案时,如果执行日志和代理标识符不可用,谁负责?多智能体语言系统越来越依赖于结构化交互,例如委托和迭代细化,但最终的输出往往掩盖了底层交互拓扑和智能体贡献。我们引入了 IET(隐式执行跟踪),这是一个独立于元数据的框架,可以直接从生成的文本中进行token级归因,以及用于交互拓扑重建的简单机制。在生成过程中,特定于代理的键控信号被嵌入到token分布中,将文本转换为只能使用密钥检测到的自描述执行跟踪。在检测时,转换感知评分方法识别代理切换点并重建交互图。实验表明,IET 可以高精度地恢复智能体分段和协调结构,同时保持生成质量,从而实现多智能体语言系统的隐私保护审计。

当只有最终文本留存时:面向多智能体审计的隐式执行追踪:论文配图
图 1:多代理系统中的代理来源恢复问题。内部执行路径和代理贡献在生成过程中可见,但由于隐私安全而在交付时被丢弃,只留下最终文本。任务是仅从文本中恢复潜在路径边界和代理参与。