Google DeepMind·· 2026-04-16精选AI 评分70
Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型
Gemini 3.1 Flash TTS: the next generation of expressive AI speech
AI 导读
Google DeepMind 推出最新文本转语音模型 Gemini 3.1 Flash TTS,支持通过嵌入自然语言命令的音频标签来精确控制声音风格、语速和表达方式。该模型在 Artificial Analysis TTS 排行榜上获得 1,211 的 Elo 分数,原生支持多说话人对话及 70 多种语言,所有生成音频均带有 SynthID 水印。
推荐理由
新模型引入自然语言音频标签以精细控制语速和风格,并在 Artificial Analysis 基准中取得高分。
来源:Google DeepMind · deepmind.google