模型
Fish Audio发布S2语音模型并开放S2 Pro权重
Fish Audio S2 发布并开放 S2 Pro 权重
概述
Fish Audio发布第二代TTS模型S2,支持在词或短语位置插入自由文本指令以控制语调、情绪和发声方式,并原生支持多说话人、多轮语音生成。参数规模为Slow AR 4B、Fast AR 400M。同批开放S2 Pro权重、微调代码及基于SGLang的流式推理引擎,平台和API可用。权重采用Fish Audio Research License,研究及非商业使用免费,商业使用需另行许可。发布日期记录为2026年3月9日。