Google 发布 Gemini 3.8 Flash TTS 双模型,支持 100+ 语言定制声音
GoogleAI · x · 2026-09-23
Google 发布两款新一代文本转语音模型:
- Gemini 3.8 Flash TTS:面向高保真创意制作(游戏、有声书、播客),可从零设计定制声音,支持逐行控制语气与表达,可添加 <laughs> 等自然提示和 |mhm| 类倾听插话。
- Gemini 3.8 Flash-Lite TTS:面向高效率规模化场景(实时语音 agent、批量配音),可自动调整语气与节奏,成本更低。
两款模型支持 100+ 语言的自定义声音或 2000+ 现成声音,可导演多轮对话,并生成数小时连贯无毛刺的音频。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(12 条相关)→
「多模态」频道最新
- Google TTS 更新支持用提示词定制语音,个性化语音助手起步 — kimmonismus · 2026-09-24
- Comfy Router 上线:一个 API 统一调用各家图像视频 3D 音频模型 — PurzBeats · 2026-09-24
- 用 Firefly Boards 无限画布,重构从未存在过的历史 — rufusd · 2026-09-24
- Opus 5.5搭配HyperFrames:3D相机加文字特效技能上线 — toolstelegraph · 2026-09-23
- 1 分钟 2 美元:用 Opus 5.5 生成推理初创公司发布视频,成本降千倍 — deedydas · 2026-09-23
- 一个周末用 Seedance 2.5 做出整集 AI 动画短片,观众喊出续集 — DeryaTR_ · 2026-09-23