Google 发布 Gemini 3.8 Flash TTS:支持 100+ 语言与 30 秒声音克隆
rseroter · x · 2026-09-23
Google 官方宣布推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,把语音合成做成“动态创作工作室”。核心能力:
- 用简单提示词从零设计定制声音,覆盖 100+ 种语言
- 逐行脚本控制语气、口音与节奏等场景细节
- 单一脚本即可生成自然轮流对话的双人语音
- 可编排笑声、叹气、倾听应答等非语言提示
- 用 30 秒音频样本复刻一致的声音档案(需拥有使用 rights)
- 提供 2000+ 生产级预置声音
所有生成音频均带 SynthID 水印,保证 AI 语音可被检测。
所属事件:Google 发布 Gemini 3.8 Flash 双 TTS 模型(13 条相关)→
「多模态」频道最新
- Seedance 2.5 + APOB 组合让 AI 网红 vlog 一条prompt拍成 30 秒短片 — aftahi_ai · 2026-09-24
- 用户让 Opus 5.5 自主制作胶片摄影史短片,耗时 90 分钟 — GabGarrett · 2026-09-24
- Dreamina AI 预置工作流:告别随机渲染的多镜头生产管线 — SarahAnnabels · 2026-09-24
- 不写复杂运镜 prompt:用 Dreamina AI 相机技能拍出手持跟拍镜头 — SarahAnnabels · 2026-09-24
- 沙特应用 Halaí 推出 Mimic 模型:几步替换任意视频中的人物 — aziz4ai · 2026-09-24
- SupraLabs 文生图模型 Supra2-IMG 登上 Hugging Face 热榜 — SupraLabs · 2026-09-24