论文
哪个 LLM 是您的理想伴侣?基于成人依恋理论的LLM情感陪伴能力评估
Which LLM Is Your Ideal Companion? Evaluating Emotional Companion Capabilities of LLMs Based on Adult Attachment Theory
摘要
随着大语言模型(LLM)越来越多地应用于情感陪伴,评估他们在亲密关系中的行为和能力已成为一个紧迫的问题。然而,现有的评估主要描述一般人格特征,对亲密和情感敏感环境中的模型行为提供有限的洞察。因此,我们将成人依恋理论引入LLM评估中,并使用亲密关系经验修订版(ECR-R)量表来表征依恋焦虑和回避。为了评估 LLM 在现实交互场景中的情感陪伴能力,我们提出了情感陪伴基准 ECBench,涵盖情感支持、协作任务、冲突解决和社交指导等四个场景,涵盖友谊和浪漫关系。 ECBench 使用 11 个对话质量指标和三种评估方法来评估模型行为。我们评估了 32 个 LLM 的依恋倾向,并选择代表性模型来研究这些倾向如何在情境化多轮交互中体现,以及它们是否可以通过提示来塑造。我们的研究提供了心理学的理论视角,以及理解和选择 LLM 进行情感陪伴的实用工具。