论文

当过时的约束不受检查时:继承的代理内存中的预算验证失败

When Stale Constraints Go Unchecked: Budgeted Verification Failures in Inherited Agent Memory

智能体系统Agent任务评测

摘要

出处链接使继承的信念背后的证据保持可达;具有验证预算的代理仍必须选择要检查的链接。我们研究了一种巩固的记忆,它规定了一个决策约束,其源记录已被撤回它的记录所取代:出处是不可变的,当前记录已更改,并且记忆已过时。在预算为两条记录的受控六内存场景中,16 个语言模型很少重新验证读取为已解决的约束:它们在大约五分之一的情节中检查其来源路径,一旦约束被取代,就会在主要运行、复制和保留域中的 77.3%、74.7% 和 74.7% 的情节中产生陈旧一致的决策。将相同的两个插槽之一重新分配给关键路径消除了其中的大部分:+74.0、+72.7 和 +61.3 点(每个模型均为正),在修复非关键控制的前瞻性冻结交错复制中为 +80.7,在来自 9 个组织的 10 个模型组成的面板上为 +62.0;修正后重新运行保留的场景得到+73.3。强制关键策略使用关键路径的实验者知识:它量化相同预算可以恢复多少陈旧决策风险,并且不是调度程序。两个进一步存放的实验定位了失败和补救措施:在这个存储中,在两个插槽中的 17.0% 的事件中选择了约束路径,在六个插槽中的四个中选择了 88.7% 的约束路径(高于统一分配),并且在两个插槽中,单句目标盲规则(首选对候选方向进行限制的记忆)将代理自己的分配移动到约束路径上,并恢复了在该约束限制的决策上的预言对比(+89.3 点)诱人的行动,而与内容无关的新鲜度提示并没有实质性地重定向分配,并且内容匹配的控制规则既没有改变选择也没有改变决定。