主要来源IT之家
查看原文事件专题 ·多源确认
谷歌推出 Gemini 3.8 Flash TTS 两款语音模型,支持逐行台词控制
谷歌发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型。Gemini 3.8 Flash TTS 在 Hume AI 语音设计基准测试中以 71.4 分位居总体第一,口音建模得 60.8 分同样领先。两款模型支持 100 多种语言、2000 多种现成语音,语音复制仅需 30 秒音频样本,并内置 SynthID 水印和 C2PA 凭据。用户可逐行编写舞台指导控制台词演绎,支持数小时长篇生成和单脚本双声音对话编排。两款模型即日起可在 Gemini API 和 Google AI Studio 中使用。
当前结论
谷歌新出的两款 TTS 模型能逐行控制台词语气,还能用 30 秒录音复制声音,做播客有声书的朋友可以去 AI Studio 试试。
3 个信源83° AI 热度最后更新 2026/9/23 15:31:11
证据链
3 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。