论文

内部动作映射的校准检验:不具备全局仿射闭合的状态信号

A Calibrated Test of Internal Action Maps: State Signals Without Global Affine Closure

模型评测模型行为与机制分析

摘要

一个隐状态信号可以是可解码或因果可用的,却不支持可复用的动作映射。我们检验未经源数据拟合的动作映射能否抵达其自然的动作后激活并能复合。我们把各项测试组织为证据格,并在已知的仿射S_5载体上验证几何分支:所有留源折叠均通过单步、复合、逆、解码与交换性门槛。结构化曲率与留域共轭使误差单调上升,但仅23/30个最强单元翻转闭合门槛,校准因此有界而非普适。在后训练的Qwen/Qwen3-4B中,冻结的末token h28仿射映射的平均留出实体误差为.519,而测试域内交叉拟合为.398。七个随机化实体划分与映射几何都不支持纯实体特定的解释。更早的h4/h16层对单步转移拟合更好,但h4的冲突态解码较弱,且词汇控制仍未解决。由同一冻结检查点再生的三个匹配干预数据集仅在h28/h36层显示因果效应。结合结果的再拟合将h28单步误差改善至.474(加权后.469),但没有任何再拟合通过复合检验。学习得到的有限世界同样保留相对代数信号或共享图册,却不具备留源仿射闭合。在受测载体范围内,状态可用性、因果使用、局部几何与可复用闭合是可分离的。该结果仅限于一个预训练模型、采样的末token层、两个有限世界以及受测的仿射或诊断函数类。

内部动作映射的校准检验:不具备全局仿射闭合的状态信号:论文配图
图S1:冻结阈值暴露出不同程度的边界敏感性。a,15 h28 个动作-种子单元格中低于各 H1 阈值的数量。红线为冻结的 0.50 门限;所有单元格首次通过是在 0.58。b,在直接映射差异与探针增益两个阈值变化而其他门保持固定时的 H2 判定;十字标记为冻结的 (0.50, 0.20) 点。c,当最小 d_z 变化时,Phase 7 h4 个种子单元格中通过顺序子门或完整 H2 的数量。仅放宽 d_z 从不改变联合 H2,因为直接门与探针门仍然不通过。没有任何面板会改变原有判定。