模型

Gemini 3.1 Flash TTS Preview:可控、有表现力的文本转语音预览版

Gemini 3.1 Flash TTS Preview 发布

应用与实践语音交互与综合语音服务

概述

Google发布Gemini 3.1 Flash TTS预览版,面向可控制、具有表现力的文本转语音生成场景。模型支持通过文本提示与音频标签控制语气、节奏等输出特征,使开发者能以声明式方式描述语音风格,而非仅依赖固定音色参数。该模型已开放API调用,并可在AI Studio中使用,便于开发者快速试听效果并集成到语音交互、有声内容生成等应用。