论文
从被动到主动:通过ProVoice-Bench评估语音智能体的主动性
From Reactive to Proactive: Assessing the Proactivity of Voice Agents via ProVoice-Bench
摘要
LLM智能体的最新进展正逐步从被动的、基于文本的范式转向主动的多模态交互。然而,现有基准主要关注被动响应,忽视了主动介入与监控的复杂性。为弥合这一差距,我们提出ProVoice-Bench,首个专为主动式语音智能体设计的评估框架,包含四项新任务。借助多阶段数据合成流水线,我们整理了1,182个高质量样本用于严格测试。我们对最先进多模态LLM的评估揭示出显著的性能差距,尤其是在过度触发与推理能力方面。这些发现凸显了当前模型的局限,并为开发更自然、更具情境感知能力的主动式智能体提供了路线图。
