模型
字节跳动正式发布统一音频创作模型Seed Audio 1.0
Seed Audio 1.0正式发布
概述
字节跳动正式发布统一音频创作模型Seed Audio 1.0,把语音、音效、环境声与场景音频生成收进同一模型:可用文本描述或参考音频定义声音,提供约100毫秒级的时间控制,单次生成最长两分钟并支持续写,覆盖20多种语言。做有声书、播客、游戏与影视音频的生产团队可测试其场景声还原与时间控制精度是否满足制作要求;发布页未见明确的商用授权与API定价信息,接入前需确认许可条款,参考音频定义声音的使用还应留意声音权利问题。