Google 发布 Gemini 3.8 Flash TTS,登顶语音设计基准
_philschmid · x · 2026-09-23
Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型:可用 30 秒音频克隆声音或用一句话描述创建新声音,提供 2000+ 现成声音和 100+ 语言支持;可逐行指导风格、自然插入笑声等提示;支持数小时一致性生成。在 Hume 语音设计基准排第一,并在 6 种语言登顶 Voice Arena。配套博客、Prompt 指南与 3.1 迁移文档。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(12 条相关)→
「多模态」频道最新
- MiniMax H3 配 Spectrum 每步多跑一遍,GPU 空转拖慢速度 — Glittering-Cold-2981 · 2026-09-24
- Google TTS 更新支持用提示词定制语音,个性化语音助手起步 — kimmonismus · 2026-09-24
- Comfy Router 上线:一个 API 统一调用各家图像视频 3D 音频模型 — PurzBeats · 2026-09-24
- 用 Firefly Boards 无限画布,重构从未存在过的历史 — rufusd · 2026-09-24
- Opus 5.5搭配HyperFrames:3D相机加文字特效技能上线 — toolstelegraph · 2026-09-23
- 1 分钟 2 美元:用 Opus 5.5 生成推理初创公司发布视频,成本降千倍 — deedydas · 2026-09-23