论文

CLAUDE.md为何越写越长?Agentic编码中的灾难性记忆

Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

智能体系统上下文与知识记忆Agent HarnessAgent记忆

摘要

像CLAUDE.md这样的agentic编码README在真实仓库中无界增长,只有当仓库退役或有人整体重写该文件时才会停止。我们将此追溯到不完美的召回:追加一条指令总是廉价,但一旦某条指令的缘由丢失,要在包含|D|条指令的提示词中删除它而不冒正确性回退风险,需要付出O(2^|D|)的代价。我们将由此产生的发散命名为“灾难性记忆”(catastrophic remembering),它是持续学习所围绕的灾难性遗忘的逆过程。首先,我们在1,867个仓库的247,694条指令生命周期上刻画这一现象:agentic提示词无界增长,生命周期内增长超过三倍(+226%),每次提交净增+4.9条指令;此外,指令越旧越不可能被删除(对数风险-0.032/提交)。其次,我们表明提示词注释可以阻止这种增长:反转IFEval可得到最优提示词已知的可验证世界,在其中编码潜在推理的注释去除了99.3%的冗余指令(从+211.3%到+1.4%)。最后,将同样的反转应用于WildIFEval,我们表明提示词注释可将真实世界agentic指令遵循提升最多23.1%。如果英语是新的代码,为什么我们还没有注释呢?