论文

RobotEQ:迈向具身智能体的社会主动智能

RobotEQ: Towards Social Proactive Intelligence in Embodied Agents

模型评测基准与评测资源

摘要

具身代理代表了学术界和工业界的一个突出研究焦点。流行的模式已逐渐从需要明确的用户查询的被动式援助转变为能够识别人类需求并在没有明确指示的情况下提供支持的主动式援助。然而,现有的主动援助研究仍然局限于狭窄的场景,并主要强调任务的完整性,而现实世界的智能体必须在开放域环境中运作,同时遵守社会期望。为了弥补这一差距,我们将主动协助的概念扩展到社会主动智能(SPI),其特点是多样化的场景、社会理解和以机器人为中心的行为。我们进一步介绍了 SPI 专用基准测试 RobotEQ。我们首先定义两个任务:行为判断,强调全局情境理解;空间目标定位,注重局部感知细节。基于这些任务,我们构建了 RobotEQ-Data,这是一个包含 1,812 个合成场景和 223 个真实场景、7 个社交方面、22K+ 人类注释、3K+ 行为判断问题和 3K+ 空间基础问题的数据集。此外,我们建立了RobotEQ-Bench来评估代表性模型的性能。实验结果表明,当前模型无法实现可靠的 SPI。进一步的分析表明,结合外部社会知识可以带来持续的改进。这项工作旨在促进开放域环境中社会所需的实体代理的开发。