DeepMind 发布 Gemini 3.8 TTS:可设计音色、克隆声音、支持插话笑场

Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 两款文本转语音模型,官方称之为迄今最具表现力的 TTS。新模型原生支持多人对话,可处理插话与笑场等自然交互;用户可用文字描述设计带独特口音与性格的自定义音色,精细控制语气、节奏、耳语与情绪,并支持声音克隆,已在 Google AI Studio 上线。

2026-09-24 ~ 2026-09-25 · 3 条相关

事件全程(共 4 集)→