论文

控制平面放置形状遗忘:跨 13 种系统配置的代理内存架构研究

Control-Plane Placement Shapes Forgetting: An Architectural Study of Agent Memory Across Thirteen System Configurations

模型评测上下文与知识记忆评测方法与指标Agent记忆

摘要

LLM 位于代理内存管道中——位于检索存储事实(经过广泛基准测试)的召回平面和通过取代、释放、清除(基本上未经测试)来改变它们的控制平面——形成系统恢复的遗忘故障模式。比较 385 例对抗表面上的 13 种系统配置,我们观察到三种具有部分互补覆盖范围的放置机制:确定性基元足以满足词汇/时间类别,但无法规范化(标识符混淆为 5%,跨语言为 0%); inscribe-time LLM 恢复规范化(100%),但无法帮助意图感知删除(前缀冲突和复合事实为 0%);突变时间挂钩恢复意图感知删除 (78-​​85%) 并同时照亮几乎所有类别(总体 91.7-93.2%,每 385 例运行 0.17 美元,2.3 秒/例修改延迟 vs. 64-191 毫秒/例确定性,召回路径不变)。我们通过 ForgetEval 揭示了这种权衡,这是一个 1000 例模板套件加上 385 例对抗层(132 个手工制作 + 253 个 LLM 起草的 Oracle 验证),通过确定性子字符串匹配进行评分,并与具有诚实 N/A 评分的六方法适配器协议配对,允许异构内存存储在 130 行中输入。入院得到 10 注释者 IAA(Fleiss' kappa = 0.958)和 77 个外部作者子集(四位盲人贡献者)的证实,该子集复制了规范化不对称性并放大了联合放置提升(+27.8 pt)。生产失败主要是遗忘失败而不是回忆失败,但现有基准仅衡量回忆。 ForgetEval 和所有适配器均在 MIT 下发布。