Gemini 3.8 TTS 上线:支持自定义声音、风格标签与 100+ 语言
AI_Andrew · x · 2026-09-24
Google 推出新的文字转语音模型 Gemini 3.8 TTS,实测者称其表现力与自然度令人惊艳。
主要特性:
- 高表现力、自然的语音生成
- 自定义声音创建,支持持久化 voice ID
- 风格标签与声音复刻
- 支持 100+ 语言
作者附了完整演示与上手 walkthrough。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(27 条相关)→
「多模态」频道最新
- 开源数据集 FineVision 获 NeurIPS 接收:17M 图、200 余源 — andimarafioti · 2026-09-25
- MiniMax H3 疑似「微笑过拟合」: bored 毛毛虫视频翻车实录 — episodex86 · 2026-09-25
- 浏览器端 3D 姿势编辑器 Pose Blueprint 开放测试 — OkConfusion6667 · 2026-09-25
- Reddit 用户仅调步数与 CFG 探索 AI 绘画的独立表达 — Extreme_Nice · 2026-09-25
- 不到 20 美元训练的 LoRA 让 Qwen-Image 单图转视角 — ben_burtenshaw · 2026-09-25
- Lingbot World v2 跑到 60 FPS,世界模型或重塑游戏开发 — bingxu_ · 2026-09-25