论文
LLM智能体会理性谈判吗?面向A2A/MCP可验证多智能体交互的机制设计框架
Do LLM Agents Negotiate Rationally? A Mechanism-Design Framework for Verifiable Multi-Agent Interaction over A2A/MCP
摘要
现代LLM智能体框架日益通过Anthropic的模型上下文协议(MCP,用于智能体到工具的访问)与Google的Agent2Agent(A2A,用于智能体委托与谈判)等标准实现互操作。然而,这些协议只规定了传输与发现,并未规定策略正确性,也不保证高效、个体理性或防策略操纵的结果。我们提出一个框架:(i) 将经典谈判机制(包括交替出价议价与VCG式拍卖)编码为对A2A消息模式的约束;(ii) 提供轻量的运行时验证与修复层,依据协议不变量检查消息;(iii) 提供带已知最优解的谈判与分配任务基准,用于度量对博弈论预测的偏离。我们以非结构化对话、结构化协议、带验证的结构化协议三种方式评估多个LLM骨干。在谈判试验中(每种条件N=30),验证降低了结果方差,而结构化协议对两个模型均达到100%成功率。在修正解析器伪影后,经审计的非结构化基线达到约97%与93.3%的成功率。在拍卖实验中(每个模型N=30),两个模型都实现了100%的有效率分配,但在真实出价上差异悬殊:一个模型在每次试验中都按其精确估值出价,另一个仅在3.3%的试验中如此。因此,机制层面的激励相容不会自动迁移为LLM智能体的行为。一个三方公平分配任务仅产生4.2%的可用结果;我们连同诊断一并报告这一负面结果。这项工作连接了经典多智能体系统理论与现代LLM智能体基础设施,并在A2A协议层定义了可验证交互。