论文
做其所说而非其所推理:定位LLM智能体中的忠实性缺口
Doing What They Say, Not What They Reason: Locating the Faithfulness Gap in LLM Agents
摘要
LLM代理人是否按照他们所说的推理行事?过程保真度问题是在社会模拟中使用大语言模型的核心,但在不存在正确行为参考的情况下很难衡量。我们在受控环境中进行研究,即德州扑克模拟器,通过将忠诚度差距分解为两个步骤:推理-结论和结论-行动,为每个决策提供可验证的参考行动。这两个步骤的行为相反。