论文
要求从未要求过的东西:座席的横向和纵向主动性
Asking for What Was Never Requested: Horizontal and Vertical Proactivity in Agents
摘要
使用工具的Agent通常会响应用户明确询问的内容,但完成任务可能需要用户从未请求过的信息。主动智能体的工作主要研究智能体是否以及何时应该自行行动,而不是它应该追求什么信息。我们研究主动性的一个独特轴:它的内容。横向主动性追求当前背景已经确定的未阐明的信息,而纵向主动性追求只有早期证据才能揭示的需求。从基准测试自身的分解中恢复的需求图记录了哪些需求依赖于哪些需求,因此两种形式以及Agent是否在正确的时间停止都可以从记录中进行评分,而无需模型判断。为了学习这种行为,我们提出了 Q&D(提问者和起草者),它训练提问者更喜欢继续检索更多所需证据的问题,而无需奖励模型或判断。在三个多跳问答基准的持续划分中,在相同的检索支出下,经过训练的提问者在同一模型上提高了两种形式的主动性,提示,并且在三个中的两个上比相同角色的提示模型高出 15 倍,并且在控制问题量和长度后,增益仍然存在。无需进一步训练,我们将提问者置于一个与模拟客户一起的交互式客户服务Agent中,它可以完成更多的任务,同时提出更少的问题,并且在零售业中,它的表现优于 15 美元\倍的大模型,而客户的后续轮流更少。这些结果表明,主动性不仅取决于智能体是否在未经询问的情况下采取行动,还取决于它选择追求什么以及何时停止。