论文
通信被污染时应分开衡量多Agent选择、公共动作与结果
Be Careful Who You Trust: Coordination Dynamics under Corrupted Communication in LLM Multi-Agent Games
摘要
LLM越来越多地被用作相互交互的Agent,但公共通信不可靠时,它们的协调鲁棒性仍不清楚。我们在由同质LLM群体参与的重复N人猎鹿博弈中研究这一问题,使用受控程序化动作翻转,同时改变公共记录与实际执行动作。在覆盖群体规模、协调门槛、污染程度及七种LLM的实验网格中,我们观察三个主要模式。第一,污染增加时,诚实Agent在翻转前选择Stag的比例下降,但公共成功率的骤降主要是机械性影响。在重点N=5、M=3设置中,80%污染下翻转前成功率仍为78%,公共成功率却降至12%。第二,诚实选择与决策时可见公共历史相关,尤其在高污染下。第三,三种阈值式公共报告基准与LLM Agent具有相近动作匹配率,表明其决策在描述层面与这些基准高度一致。总体结果说明,评估多Agent鲁棒性时必须分开原始选择、公共动作和执行结果,因为污染通信能够严重且可预测地损害互利合作。