论文
自利智能体社会市场稳定性的形式机制:市场仿真研究
Formal Mechanisms for Market Stability in Self-Interested Agent Societies: A Marketplace Simulation Study
摘要
自利智能体若无约束,在重复社会困境中趋向背叛——使贸易的合作收益崩溃。本文研究:在无限制通信之上叠加哪些形式机制,足以让此类智能体社会维持市场稳定,以及这些机制对对抗攻击的韧性。我们把研究问题实例化为多智能体市场仿真:18个具有互补生产专长的LLM智能体(DeepSeek-V3)必须在受限社交网络内交易以获得效用。我们执行两个实验阶段:(1) 跨八个条件、在200轮渐进巨魔注入下的机制比较——识别出调解(Mediation)为表现最佳的机制;(2) 用经迭代提示优化的LLM驱动巨魔对调解做对抗红队——发现最佳攻击(v6)使诚实智能体效用降低13.3%但无法崩溃市场。即使在持续对抗压力下,调解也能实现恢复。我们把对抗鲁棒性定义为机制在优化攻击下维持正的诚实智能体效用的能力,并发现调解是鲁棒的:可以被弯曲但不能被打断。
