论文

为什么我们需要一个评估AI情绪智能的新框架

Why We Need a New Framework for Emotional Intelligence in AI

模型评测评测方法与指标

摘要

在本文中,我们提出这样一个立场:当前用于评估人工智能(AI)系统情绪智能(EI)的框架需要改进,因为它们未能充分、全面地测量与AI相关的EI的各个方面。人类的EI常常涉及现象学成分和一种理解感,而人工智能系统并不具备;因此,EI的某些方面在评估AI系统时并不相关。但EI也包括感知情绪状态、解释它、做出恰当回应并适应新情境(如多元文化情境)的能力,而人工智能系统可以在不同程度上做到这些。已有若干基准框架专门评估不同AI模型执行某些与EI相关任务的能力,但它们往往在情绪的本质以及何为情绪智能这一问题上缺乏坚实基础。在本项目中,我们首先梳理关于情绪和一般EI的不同理论,评估各理论在多大程度上适用于人工系统。随后我们批判性地评估现有的基准框架,依据第一部分建立的EI论述逐一指出其不足之处。最后,我们概述了改进评估策略的若干选项,以避免在AI系统的EI评估中出现这些缺陷。