论文
压力下的逻辑判断:用学习到的软前缀诊断三段论稳定性
Logical Judgments Under Pressure: Diagnosing Syllogistic Stability with Learned Soft Prefixes
摘要
为检验正确的逻辑判断如何响应学到的上下文,我们在一个精确标注的三段论推理基准前拼接软前缀,同时保持模型固定。软前缀是不透明的连续向量,我们通过它们在逻辑形式与接口的受控变化下诱发的行为来刻画。通过研究哪些前缀成功、其效应如何泛化,我们刻画了学到的上下文压力如何覆盖正确判断、暴露模型逻辑稳定性的局限。在Qwen3.6-35B-A3B MoE、Qwen3-8B与Gemma 4 31B上,学到的前缀使大量正确答案翻转,并在未见形式与接口变化下保持有效。在Qwen3.6 MoE与Gemma的重复测试中,它们在全部16个模型—方向—划分比较中以37至99个百分点优于配对随机对照;Qwen3.6 MoE的翻转率在措辞与提示变化间保持72%–90%,Gemma有效性前缀保持54%–56%翻转,而配对随机前缀不足1%。诊断测试表明主导效应是对某个答案含义的广泛偏好,而非固定符号强制或可在任务间可靠迁移的逻辑操作。该偏差的形式因模型而异:两个Qwen模型中,简单分数模型常能预测哪些判断会翻转、却预测不了裕度移动多远;Gemma的总体响应则更接近被这些模型近似。结果表明,成功软前缀的主导行为效应是广泛的答案偏好,而其余响应揭示模型在逻辑稳定性上实质性的模型间差异。