论文

受限路径推理:度量承诺阶段的收益何时超过成本

Constrained Path Reasoning: Measuring When Committed Stages Earn Their Cost

模型推理推理策略与问题分解

摘要

LLM推理管线中一个已承诺的中间阶段何时能赚回其成本?受限路径推理(CPR)把源感知的路径假设与阶段级核算配对:搜索生成临时状态;受信任或经验证的不变式可以做硬约束,其他提议保持软性、可修订。CPR预测:与任务兼容的承诺在其收益超过传播误差与执行成本时,能分解转移、集中候选质量、诱发规律性并暴露反馈。该形式化覆盖离散承诺与连续流,度量有效分支、终点集中度与每可用输出的成本。在1,180个生成的QCQP与40个工程化退化多项式实例(2,140个端点)上,残余分诊以17.7%的尝试次数收回全部修复63.0%的新增可行产出。固定LLM核算(嵌套臂共享270次唯一调用)发现可用产出:直接41.1%、形式化与确定性执行后90.0%、一次性凸化后20.0%、完整路径21.1%。在120次配对条件调用中,双动作回滚规则达到90%可用产出,对比反馈条件选择器的36.7%。两个端点探针分离源与验证:72输出的跨轨迹移植降低熵与可接受质量;24输出的同调用自提议试点给出不变的双重复碰撞熵、25.0%对8.3%的可用产出,以及1/8的确定性确认端点检查。模型生成的状态提供假设;受信任的执行赚取约束强度。

受限路径推理:度量承诺阶段的收益何时超过成本:论文配图
图 7:每个问题阶段包结果。每个单元格是三个样本中可用输出的数量。问题首先按紧 SDR 排序,然后按松散 SDR 排序,然后按每组内的真实 SDR 残差排序;虚线标记组边界。标记识别松散的 SDR 和问题,其预言值由 SDR 下限认证。