Google 发布 Gemini 3.8 Flash TTS:支持 100+ 语言与 2000+ 预置音色
AI_Andrew · x · 2026-09-23
Google 推出两款语音生成模型:Gemini 3.8 Flash TTS 面向富有表现力的细腻配音,3.8 Flash-Lite TTS 面向大批量、低成本场景。两者覆盖 100+ 语言。
主要新能力:
- Voice Design:用简单文本提示跨语言、方言与口音定制音色
- 2000+ 预置音色:高保真库覆盖多样风格与人设
- Voice Replication:快速真实的声音复刻,内置同意验证
- 多说话人对话:不同声音之间自然流畅的节奏衔接
现已在 Google AI Studio 可用,面向开发者与创作者。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(12 条相关)→
「多模态」频道最新
- Google TTS 更新支持用提示词定制语音,个性化语音助手起步 — kimmonismus · 2026-09-24
- Comfy Router 上线:一个 API 统一调用各家图像视频 3D 音频模型 — PurzBeats · 2026-09-24
- 用 Firefly Boards 无限画布,重构从未存在过的历史 — rufusd · 2026-09-24
- Opus 5.5搭配HyperFrames:3D相机加文字特效技能上线 — toolstelegraph · 2026-09-23
- 1 分钟 2 美元:用 Opus 5.5 生成推理初创公司发布视频,成本降千倍 — deedydas · 2026-09-23
- 一个周末用 Seedance 2.5 做出整集 AI 动画短片,观众喊出续集 — DeryaTR_ · 2026-09-23