论文

继承代理内存预算验证中的计划指针和记录指令形式

Plan Pointers and Record-Directive Form in Budgeted Verification of Inherited Agent Memory

模型评测安全与风险评测

摘要

继承单行内存的模型可以在执行之前提取一条存档的源记录;存储中的指令可以控制该拉动:指针、标准或两者。在 16 项注册研究(179,352 次尝试)中,我们测量了每个表格下请求的位置;每个结果都是描述性的,具有注册的间隔,没有机制声明。长度匹配标准在六个直接提供商模型 (D) 上超出了裸 ID,并且在九个模型 OpenRouter 面板 (E) 上未达到其注册优势规则。在生成的世界(K2-K5)上:Opus 5 和 Fable 5.1 上持有的两个注册签名、Fable 5 遵循相同的符号,Haiku 4.5 反转,而 Sonnet 5、GPT-5.6 端点和 GPT-6 Astra 接近于零(K2)。对于具有五个增益的防御适配器,不满足复合标准对比度的增益相关变化的 70B 规则(K3 和 K4);根据 8B 衰减规则(0.95 间隔:斜率低于零;变化超出裕度),-17.5 [-26.7, -8.1] 的 8B 变化在 36 个系列 (K4) 上未满足要求,而在 337 个系列的注册功率下 -16.6 [-19.4, -13.8] 满足要求(在有限的每个角的裕度 1.8 至 3.2% 处实现单边误差)网格,标称 2.5%,不是统一错误保证;K5,第一个梯子),而强加的 Meta-SecAlign 模板下的第二个 SecAlign++ 适配器则没有(-11.8 [-14.3,-9.3];K5,第二个梯子); no NOT-MET 是对比度未改变的声明;它们的差异 (+4.7 [+2.3, +7.2]) 描述了两个固定的执行路径,不许可任何优越性、等价性或“显着差异”声明;不同的状态(K5)不会产生任何结果。间隔描述了以执行为条件的系列重新加权稳定性,而不是引擎执行之间的再现性;审计重播既不能替代结果,也不能平均化为结果;没有触发缺失门,定向完成也没有改变状态。