Google 发布 Gemini 3.8 Flash TTS,支持 100+ 语言定制声音
kastnerkyle · x · 2026-09-24
Google AI 官方推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款音频生成模型,可跨 100+ 语言创建定制声音,或从 2000+ 预置音色中选择。支持逐行指导台词表达、导演多轮对话,可用 <laughs>、|mhm| 等自然语气标记,并能生成数小时连贯无故障的音频。
- Flash TTS:面向从零设计专属声音人格,支持逐行级控制,适合游戏、沉浸式有声书、播客等高保真创意生产
- Flash-Lite TTS:轻量版本,面向更轻量的语音生成场景
Hume AI CEO Alan Cowen 转发点评称这是他「用过的最自然、最有表现力的语音模型」,并认为 TTS 已不再是「小模型」问题:模型越前沿,越能理解自己说的话,听起来也就越像理解了内容。还支持用文本 prompt 设计各种口音、方言与说话风格,如「吸血鬼冥想导师(特兰西瓦尼亚口音)」「瑞典语 ASMR 家具评测」等。
所属事件:谷歌发布 Gemini 3.8 Flash 双 TTS 模型(18 条相关)→
「模型」频道最新
- 不是所有 AI 任务都需要 LLM:小型分类决策可省时省成本 — bigdata · 2026-09-24
- Gemma 4 可在 Antigravity SDK 完全离线运行,零 API 成本 — DynamicWebPaige · 2026-09-24
- Claude 终端里的模型选择器:从简洁一路膨胀成表情包 — ColleenMBrady · 2026-09-24
- 用户吐槽:做 2 小时 demo 就烧掉 15% 周配额,直呼订不起更多订阅 — BLUECOW009 · 2026-09-24
- Opus 5.5用Krea MCP一次成型视频:10分钟花8美元 — angrypenguinPNG · 2026-09-24
- Claude Opus 5.5 登顶写作榜,2631 Elo领先第二名307分创纪录 — teortaxesTex · 2026-09-24