论文

解释均衡:以可核验推理促进信息不对称下的多Agent协作

Toward Explanatory Equilibrium: Verifiable Reasoning as a Coordination Mechanism under Asymmetric Information

智能体系统Agent 动作执行与治理

摘要

基于大语言模型的Agent越来越多地在多Agent系统中协调决策,并为行动附加自然语言推理。但推理既有计算成本,也并非天然可靠;缺少核验时,它可能退化为有说服力却无法验证的说辞。本文提出解释均衡,作为重视解释的多Agent系统的设计原则。Agent交换可审计主张及简短说明,接收者在明确的资源约束下,通过概率审计进行有限核验。研究建立一个连接审计强度、虚假报告激励与推理成本的推理交换—审计模型,并在交易员与风险经理参与的金融实验场景中验证。在边界模糊的提案中,可审计的材料能够减轻信息不对称下保守核验带来的沉默成本;缺少结构化主张时,批准率和总体效益明显下降。相比之下,结构化推理促进协调,并在不同审计强度、预算和激励设置下保持较低的错误批准率。结果表明,可扩展且兼顾安全的多Agent协调,除了审计力度,还依赖将推理以规范形式表达为可部分核验的材料。