模型
Gemini 3.1 Flash TTS Preview:可控、有表现力的文本转语音预览版
Gemini 3.1 Flash TTS Preview 发布
概述
Google发布Gemini 3.1 Flash TTS预览版,面向可控制、具有表现力的文本转语音生成场景。模型支持通过文本提示与音频标签控制语气、节奏等输出特征,使开发者能以声明式方式描述语音风格,而非仅依赖固定音色参数。该模型已开放API调用,并可在AI Studio中使用,便于开发者快速试听效果并集成到语音交互、有声内容生成等应用。