论文
答案工程:面向LLM协议约束决策的局部轨迹编辑
Answer Engineering: Local Trajectory Editing for Protocol-Constrained Decision Making in Large Language Models
摘要
在程序合规至关重要的领域——大语言模型可能产出自信但违反协议的答案。本文提出答案工程——确定性运行时与撰写层——在标准自回归生成期间对可见推理轨迹施加局部规则引导干预——无需重训练、修改模型权重或全局搜索。该方法在突发性感音神经性听力损失(SSNHL)的受控临床基准上评估——正确管理依赖对症状时序、Weber/Rinne音叉发现与耳镜发现的协议一致解读。基准中——逐步推理转移而非消除错误:SSNHL合规结果从无引导生成的54.5%降到25.1%——而传导性对照条件的接受从1.6%升到58.9%。局部轨迹编辑把SSNHL合规提升到83.5%——传导病例遵循提升到77.9%——把平衡准确率从仅推理生成的42.0%提升到80.7%。结果支持系统级观点:协议遵循可经推理轨迹的可审计运行时控制改进——同时识别规则覆盖、触发可靠性与持续的“诊断优先”生成动力学造成的局限。