论文

实用性之前的权威:持久LLM内存的非补偿性控制

Authority Before Utility: Non-Compensatory Control for Persistent LLM Memory

上下文与知识记忆Agent记忆

摘要

持久性内存产生了一个仅靠检索相关性无法解决的控制问题:在更新、删除或撤销使其对于当前答案不可接受之后,内存仍然可以保持高度有用。我们将其形式化为效用与权威之间的分离。应用于非标准化效用得分的固定有限惩罚不能保证在该得分的任意正仿射重新参数化下排除;相比之下,排名归一化补偿是尺度不变的,因此形成了更强的经验比较器。我们预期冻结的 TIDE/LongMemEval 主节点在有效的 HELDOUT 比较之前被隔离,因为物化的 TIDE 适配器将历史年龄与查询相关的不可接纳性混为一谈,并且对齐的 LongMemEval 拆分没有为预先声明的惩罚选择设置 DEV。因此,我们报告了关于 Memora Remembering 的初级后替换诊断,其中更新/删除操作提供项目级遗忘状态。在 Qwen3-8B 上,DEV 从十点归一化 SOFT 系列中选择 lambda = 0.6。在 28 个依赖集群中的 185 个 HELDOUT 单元中,HARD 排除产生 4.04% 的平衡构造错误,而锁定 SOFT 则产生 19.66%,配对差异为 15.61 点,20,000 个复制集群引导 95% 区间为 [13.07, 18.76]。这种效应主要是由遗忘值泄漏引起的,同时保留了当前值回忆。这是同 Q 运算符比较证据,不是标量控制失败的普遍主张,不是对学习权威推断的评估,也不是独立的下游危害端点。