论文
大语言模型的行为就像理性智能体吗?衡量概率决策中的信念一致性
Do LLMs Act Like Rational Agents? Measuring Belief Coherence in Probabilistic Decision Making
摘要
大语言模型(LLM)越来越多地被部署为高风险领域的代理,其中最佳行动取决于世界的不确定性和对不同结果效用的考虑,但它们的决策逻辑仍然难以解释。我们研究大语言模型是否是具有连贯信念和稳定偏好的理性效用最大化者。我们考虑诊断挑战问题的模型行为。结果提供了关于大语言模型推论与理想贝叶斯效用最大化的关系的见解,以得出概率和观察到的行动。我们的方法提供了可证伪的条件,在该条件下,报告的概率 \emph{不能} 对应于任何理性主体的真实信念。我们将此方法应用于多个医学诊断领域,并对多个大语言模型进行评估。我们讨论了结果的影响以及使用大语言模型指导高风险决策的未来方向。