Google 发布两款新 TTS 模型:支持克隆音色与 100+ 语言
tulseedoshi · x · 2026-09-24
Google 发布两款新的文本转语音(TTS)模型,可创建全新的原创表现力音色,或克隆用户自己的声音,支持超过 100 种语言的高质量语音生成。官方强调语音正成为人机交互越来越重要的方式,新模型面向创意与表达场景。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(27 条相关)→
「多模态」频道最新
- 开源数据集 FineVision 获 NeurIPS 接收:17M 图、200 余源 — andimarafioti · 2026-09-25
- MiniMax H3 疑似「微笑过拟合」: bored 毛毛虫视频翻车实录 — episodex86 · 2026-09-25
- 浏览器端 3D 姿势编辑器 Pose Blueprint 开放测试 — OkConfusion6667 · 2026-09-25
- Reddit 用户仅调步数与 CFG 探索 AI 绘画的独立表达 — Extreme_Nice · 2026-09-25
- 不到 20 美元训练的 LoRA 让 Qwen-Image 单图转视角 — ben_burtenshaw · 2026-09-25
- Lingbot World v2 跑到 60 FPS,世界模型或重塑游戏开发 — bingxu_ · 2026-09-25