谷歌发布 Gemini 3.8 Flash TTS,可用文字描述定制音色
The Decoder · rss · 2026-09-24
谷歌推出两款新文本转语音模型 Gemini 3.8 Flash TTS 与 Flash-Lite TTS,支持超过 100 种语言。
Flash TTS 可通过文字描述从零创建全新音色,两款模型均支持为单行台词添加舞台指示,并能用一份脚本生成双人对话。此外还提供声音克隆功能,仅需 30 秒样本即可构建音色档案。
「模型」频道最新
- 四款新模型一周改写性价比前沿,Opus 5.5 以 58 分登顶 — ArtificialAnlys · 2026-09-24
- Opus 5.5 系统卡藏玄机:METR 用了暂不公开的信源了解 Anthropic 研发 — coherence · 2026-09-24
- 用户实测:6 Sol 模型 max 档表现不如 Astra Light,回归频发 — pwlot · 2026-09-24
- 不是所有 AI 任务都需要 LLM:小型分类决策可省时省成本 — bigdata · 2026-09-24
- Gemma 4 可在 Antigravity SDK 完全离线运行,零 API 成本 — DynamicWebPaige · 2026-09-24
- Claude 终端里的模型选择器:从简洁一路膨胀成表情包 — ColleenMBrady · 2026-09-24