跳到正文
原文
Google DeepMind·· 2026-04-16精选AI 评分62

Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型

Gemini 3.1 Flash TTS: the next generation of expressive AI speech

AI 导读

Google DeepMind 发布 Gemini 3.1 Flash TTS,这是最新的文本转语音模型,主打更强的可控性、表现力和质量。该模型在 Artificial Analysis TTS 榜单上取得 Elo 1211 分,支持 70 多种语言和原生多说话人对话,并引入音频标签功能,可通过自然语言指令精细控制语速、语气和表达。

推荐理由

官方介绍了新 TTS 模型的音频标签控制能力和评测成绩,读者可据此判断其表达力与可控性提升。

来源:Google DeepMind · deepmind.google