论文
记忆更新而行为未变:修复个性化Agent响应中的隐式过期依赖
When Memory Updates but Behavior Does Not: Repairing Implicit Stale Dependencies in Personalized Agent Responses
摘要
记忆增强代理知道用户存储状态过时,仍然计划绕过旧值。STALE基准将此称为隐性策略适应(IPA)差距。我们识别一个结构上的贡献者:验证检查响应,而在开放性响应中,通常没有提及旧依赖。StateAuditor因此审计从存储状态到草稿的方向。一个LLM提出从时间戳证据中候选旧到新转换;确定性代码将每个引文绑定到单个条目,检查新证据是否确实更新,并允许只有这些经过验证的转换触发修复。被验证的是来源和时间顺序,而不是语义替换。在STALE的完整协议(400个场景,50个会话历史,每个查询独立响应)中,严格单个查询VTA分数为0.736,而我们的锁定前驱器在相同的法官下为0.686:+5.0点配对收益(95%置信区间:+2.9,+7.2)。来自STALE基准的自身法官,来自第三个模型家族,再现了收益(0.738 vs. 0.680)。在独立跨模型偏好进化基准(HorizonBench)上,完整的草稿审计修复管道在金库衍生的结构存储上提高了当前偏好准确率(用户聚类p<0.01),尽管匹配控制显示大部分外部收益来自草稿审计本身;一个更难的作者生命周期集没有收益,限制了声称,但虚假无效化保持控制。相比之下,在STALE上,匹配控制(相同证据、适配器和调用预算)仅得分为0.692(+0.6超过前驱器,n.s.),将STALE收益归因于转换机制而非附加上下文或调用。我们对一般用途代理记忆没有做出一般性声明。
