论文
当只有最终文本幸存时:多代理归因的隐式执行跟踪
When Only the Final Text Survives: Implicit Execution Tracing for Multi-Agent Attribution
摘要
当多代理系统产生不正确或有害的答案时,如果执行日志和代理标识符不可用,谁负责?多智能体语言系统越来越依赖于结构化交互,例如委托和迭代细化,但最终的输出往往掩盖了底层交互拓扑和智能体贡献。我们引入了 IET(隐式执行跟踪),这是一个独立于元数据的框架,可以直接从生成的文本中进行token级归因,以及用于交互拓扑重建的简单机制。在生成过程中,特定于代理的键控信号被嵌入到token分布中,将文本转换为只能使用密钥检测到的自描述执行跟踪。在检测时,转换感知评分方法识别代理切换点并重建交互图。实验表明,IET 可以高精度地恢复智能体分段和协调结构,同时保持生成质量,从而实现多智能体语言系统的隐私保护审计。
