论文
人类会退出、推理模型会坚持:分离难度登记与深思分配
Humans Disengage, Reasoning Models Persist: Separating Difficulty Registration from Deliberation Allocation
摘要
大型推理模型(LRM)倾向对人类也花更多时间的问题产生更长的推理踪迹。这种对应提示对难度的共享敏感性——但困难问题既可引发坚持也可引发退出。我们区分难度登记(表现为哪些问题引发更多深思)与后续工作的分配。我们在视觉抽象、直觉物理与关系推理的匹配人类与LRM数据中考察两者关系。在视觉抽象上——模型踪迹长度追踪人类按用时的问题排序。在控制题目身份后——成功的人类尝试比失败尝试持续更久——而失败LRM尝试的踪迹长于成功的(合并模型分析)。估计的结果斜率在直觉物理上遵循相同模式。在关系推理中——分离的人类与模型分析中成功尝试更长。以共享题目效应拟合两组产生人类-LRM在用时与结果关系上的差异。人类网格动作把更长尝试与持续任务投入相连。失败LRM踪迹在控制长度后包含更多对冲或重复——差异形式随任务而变。资源理性解释说明:不确定性的预期可约简性与赋予后续计算的价值如何能在难度敏感性相似时产生不同的坚持模式。因此——对哪些问题需要更多深思的共识可以与对这些问题的不同坚持模式共存。
