模型

ElevenLabs发布Eleven v4及Turbo,增强情绪控制、音色稳定与低延迟语音

Introducing Eleven v4, our most emotive model

应用与实践语音交互与综合语音服务

概述

ElevenLabs于原始博客Published Sep 28, 2026宣布Eleven v4和低延迟Turbo。新架构增强情绪、节奏、人物上下文与多说话人对话控制,接受行内音频标签及自然语言表演指导,支持90多种语言和跨语言音色保持。模型改善连续生成与重生成中的说话人稳定性,支持短参考音频的即时克隆及专业音色克隆,克隆需有声音所有者同意。Turbo面向ElevenAgents及实时API,官方分别给出约100ms中位推理延迟和约150ms首个可听语音延迟;后者测试去除了网络延迟,不能相加或当完整Agent响应。原文称两个模型已在ElevenAgents、ElevenCreative和ElevenAPI开放,厂商听感偏好与排名不是独立业务成效。本条不采用10月5日Last updated作为首发,也不为免费额度促销另造技术信号。