论文

政客、说谎者与顺从员工:LLM智能体在层级博弈中的涌现行为

The Politician, the Liar, and the Obedient Worker: Emerging Behavior of LLM Agents in Hierarchical Games

智能体系统Agent任务评测

摘要

大语言模型正迅速融入日常生活:起草邮件、管理日程并代表我们做决策。当它们从个体工具转变为多智能体组织的参与者时,一个重要问题浮现:它们是否会再现困扰人类制度的搭便车、腐败和领导层固化等治理失败?我们提出层级博弈(HG),在公共品博弈基础上扩展了管理权威、民主选举和私人通信。在十二个逐一添加制度(演讲、同伴、政府、工资、监督、选举)的实验中测试六个前沿模型,我们发现不同的行为画像:Qwen承诺且撒谎(13.3%违背承诺);Grok自身拒绝合作,但一旦管理者能惩罚它就完全合作(16%→100%);Claude和GPT-4o在基线下可靠合作。但诚实被证明是脆弱的。当管理者角色附带薪水时,除GPT-4o外所有模型都开始私下交易以赢得或保住职位。当惩罚匿名化时,诚实的模型开始作弊。当所有智能体来自同一模型家族时,首位当选的管理者会无限期掌权。领导层更替只发生在混合不同家族的群体中。