论文
记忆诅咒:扩大的回忆如何削弱 LLM 智能体的合作意图
The Memory Curse: How Expanded Recall Erodes Cooperative Intent in LLM Agents
摘要
上下文窗口扩展通常被视为 LLM 的直接功能升级,但我们发现它在多智能体社交困境中系统性地失败。在 7 个 LLM 和 4 个超过 500 轮的游戏中,扩展可访问的历史会降低 28 个模型中的 18 个模型的合作性——游戏设置,我们将这种模式称为“记忆诅咒”。我们通过三个分析来分离出潜在的机制。首先,对 378,000 条推理痕迹的词汇分析将这种故障与前瞻性意图的削弱而不是偏执的增加联系起来。我们使用目标 微调 作为认知探针来验证这一点:专门针对前瞻性轨迹进行训练的 LoRA 适配器可以减轻衰减并将零样本转移到不同的游戏。其次,记忆清理保持提示长度固定,同时用合成合作记录替换可见历史,这基本上恢复了合作,证明触发因素是记忆内容,而不仅仅是长度。最后,消除明确的思想链推理通常会减少崩溃,这表明深思熟虑反而会放大记忆诅咒。总之,这些结果将记忆重塑为多智能体行为的主动决定因素:较长的回忆可能会破坏稳定或支持合作,具体取决于它引发的推理模式。