Google DeepMind·· 2026-04-16精选AI 评分79
Google 发布 Gemini 3.1 Flash TTS 语音模型
Gemini 3.1 Flash TTS: the next generation of expressive AI speech
AI 导读
Google 发布 Gemini 3.1 Flash TTS,提升语音质量、可控性和表现力,并支持原生多说话人对话及 70+ languages。模型新增 audio tags,可通过自然语言控制语气、语速和表达方式,并在 Gemini API、Google AI Studio、Vertex AI 和 Google Vids 中分阶段提供预览或使用。
推荐理由
Gemini 3.1 Flash TTS 将音频标签、场景指令和说话人设置结合,展示了开发者如何更细致地控制语音表达与多轮角色表现。
来源:Google DeepMind · deepmind.google