模型

Stable Audio 3.0:Stability AI按秒可控的音频生成模型家族

Stable Audio 3.0模型家族发布

应用与实践内容创作

概述

Stability AI于2026年5月20日发布Stable Audio 3.0音频生成模型家族,包含Small SFX、Small、Medium和Large四档。新架构支持按秒控制的可变长度生成、音频到音频转换、局部重绘与续写;Small最长生成2分钟,Medium与Large可超过6分钟。开放策略分层:前三档提供可下载权重,Large通过Stability AI API及企业自托管提供。