DeepMind 发布 Gemini 3.8 TTS:可设计音色、克隆声音、支持插话笑场
Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 两款文本转语音模型,官方称之为迄今最具表现力的 TTS。新模型原生支持多人对话,可处理插话与笑场等自然交互;用户可用文字描述设计带独特口音与性格的自定义音色,精细控制语气、节奏、耳语与情绪,并支持声音克隆,已在 Google AI Studio 上线。
2026-09-24 ~ 2026-09-25 · 3 条相关
- 第 1 集:谷歌发布 Gemini 3.8 Live 双模型:登顶语音榜且价格减半(2026-09-15,29 条)
- 第 2 集:Artificial Analysis 评测:Gemini 3.8 Live 语音能力全面领先(2026-09-16,7 条)
- 第 3 集:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(2026-09-22,27 条)
- 第 4 集:DeepMind 发布 Gemini 3.8 TTS:可设计音色、克隆声音、支持插话笑场(2026-09-24,3 条)
- DeepMind 发布 Gemini 3.8 TTS,原生支持多人对话与插话笑场 — kastnerkyle · 2026-09-24
- Google 推出 Gemini 3.8 Flash TTS:文本描述设计音色、克隆声音 — rseroter · 2026-09-25
- Google AI Studio 发布 Gemini 3.8 Flash TTS,可像模型一样用提示词导声音 — CurieuxExplorer · 2026-09-25