模型

ElevenLabs 发布 Scribe v2 语音识别模型

Scribe v2发布

应用与实践语音识别与转写

概述

Scribe v2 是 ElevenLabs 发布的新一代语音识别模型,主要面向长录音和批量处理场景。本次更新包括:提升长音频转写的稳定性与准确性;新增上下文关键词提示机制,为转写提供输入上下文引导;增加实体检测;支持单文件内多语言转写。输出除文本外还包括说话人标签、时间戳、实体及非语音事件标注。模型于发布当天通过 ElevenLabs API 与 Creative 平台提供,未披露开放权重。