论文

DeepSpeak-Agentic数据集

The DeepSpeak-Agentic Dataset

模型评测基准与评测资源

摘要

我们展示了 DeepSpeak-Agentic,这是一个视频数据集,包含人类和具体 AI 代理之间超过 37 小时的半结构化对话。我们使用该数据集来评估人工智能代理的自动取证识别(音频、视频或文本),研究人机交互的本质,并为大语言模型和人工智能生成的声音和面孔的未来发展提供基准,为具体的人工智能代理提供动力。我们还提供了一个可扩展的数据捕获系统,该系统创建代理,自动将它们与人类工作人员配对,记录指定场景中的视听对话,并识别和分离组合流中的人和代理。

DeepSpeak-Agentic数据集:论文配图
图 1:人工智能代理(左)和人类(右)之间对话的代表性示例。