论文

GPT-4o缺乏心智理论的核心特征

GPT-4o Lacks Core Features of Theory of Mind

模型评测模型能力评测

摘要

大型语言模型(LLM)是否拥有心智理论(Theory of Mind,ToM)?对这一问题的研究一直聚焦于用基准评测LLM,并在一系列社会任务上发现了成功。然而,这些评测并未检验ToM所假定的实际表征,即关于心理状态与行为的因果模型。在此,我们使用一个基于认知科学的ToM定义来开发并检验一个新的评估框架。具体而言,我们的方法探测LLM是否拥有一个连贯的、领域一般的、一致的关于心理状态如何导致行为的模型——无论该模型是否与类人的ToM相符。我们发现,尽管LLM能在一个简单的ToM范式中逼近人类判断,它们却在逻辑等价的任务上失败,并且在动作预测与相应心理状态推断之间表现出低一致性。因此,这些发现表明,LLM展现出的社会熟练度并非源自一个领域一般且一致的ToM。