Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型
patloeber · x · 2026-09-23
Google AI Studio 官方宣布推出两款新的语音生成模型:
- Gemini 3.8 Flash TTS 与 3.8 Flash-Lite TTS:官方称是其「最具表现力的音频生成模型」。
- 可用性:开发者可通过 Gemini API 与 AI Studio 直接试用。
面向创作者、开发者与企业的更丰富语音体验场景,是 Gemini 系列在语音/TTS 方向的正式扩展。
所属事件:Google 发布 Gemini 3.8 Flash/Flash-Lite TTS:30 秒克隆声音,覆盖 100+ 语言(14 条相关)→
「多模态」频道最新
- Comfy Router 上线:一个 API 统一调用图像视频 3D 音频模型 — cpaik · 2026-09-24
- 一张图变千个故事:Midjourney 搭 Seedance 2.5 演示 — umesh_ai · 2026-09-24
- Google 发布 Gemini 3.8 Flash 与 Flash-Lite 两款文本转语音模型 — Recoil42 · 2026-09-24
- 用 Gemini 做音频转写+动态字幕+硬件加速渲染的完整视频工作流 — AI_Andrew · 2026-09-24
- 自制 Minimax H3 工作流:多图+音频+视频混合参考输入 — TheNeonGrid · 2026-09-24
- R2 技术拆解:动态分块适配输入类型,多时间尺度记忆维持世界一致性 — SarahAnnabels · 2026-09-24