Google DeepMind 发布 Gemini 3.8 文本转语音,可 30 秒克隆声音
Google DeepMind · youtube · 2026-09-23
Google DeepMind 官方发布 Gemini 3.8 文本转语音模型:
- 定制声音:用自然语言 prompt 从零设计全新声音人格,适用于游戏、有声书、双人播客,可逐句导演表演提示、节奏、附和声与方言切换。
- 声音克隆:只需 30 秒音频样本即可复现一致的成人声音(须拥有使用权)。
- 安全配套:内置同意验证、SynthID 水印与 C2PA 凭证,保护开发者与配音演员。
模型已上线,可通过 Google 博客链接开始使用。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(12 条相关)→
「多模态」频道最新
- SupraLabs 文生图模型 Supra2-IMG 登上 Hugging Face 热榜 — SupraLabs · 2026-09-24
- 哼歌成曲:yue2-hum-to-song 应用登上 Hugging Face 热榜 — Mothersuperior · 2026-09-24
- 一张图片生成喷气机 3D 模型,Grok 4.7 展示图生 3D 能力 — XFreeze · 2026-09-24
- MiniMax H3 配 Spectrum 每步多跑一遍,GPU 空转拖慢速度 — Glittering-Cold-2981 · 2026-09-24
- Gemini 3.8 Flash TTS 发布:30 秒音频即可复刻声音 — kimmonismus · 2026-09-24
- Google TTS 更新支持用提示词定制语音,个性化语音助手起步 — kimmonismus · 2026-09-24