Google 发布 Gemini 3.8 Flash TTS,支持 100+ 语言定制声音

kastnerkyle · x · 2026-09-24

Google AI 官方推出 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS 两款音频生成模型,可跨 100+ 语言创建定制声音,或从 2000+ 预置音色中选择。支持逐行指导台词表达、导演多轮对话,可用 <laughs>、|mhm| 等自然语气标记,并能生成数小时连贯无故障的音频。

Hume AI CEO Alan Cowen 转发点评称这是他「用过的最自然、最有表现力的语音模型」,并认为 TTS 已不再是「小模型」问题:模型越前沿,越能理解自己说的话,听起来也就越像理解了内容。还支持用文本 prompt 设计各种口音、方言与说话风格,如「吸血鬼冥想导师(特兰西瓦尼亚口音)」「瑞典语 ASMR 家具评测」等。

所属事件:谷歌发布 Gemini 3.8 Flash 双 TTS 模型(18 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →