Google 上线 Gemini 3.8 Flash/Flash-Lite TTS,支持克隆音色与逐句情感控制
petrusenko_max · x · 2026-09-24
Google 于 9 月 23 日发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音模型。可用 prompt 定制音色或复刻已有声音,支持逐句指定语速与情感方向,并自带水印。已在 AI Studio、Gemini API 和 Vids 中可用。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(27 条相关)→
「多模态」频道最新
- 开源数据集 FineVision 获 NeurIPS 接收:17M 图、200 余源 — andimarafioti · 2026-09-25
- MiniMax H3 疑似「微笑过拟合」: bored 毛毛虫视频翻车实录 — episodex86 · 2026-09-25
- 浏览器端 3D 姿势编辑器 Pose Blueprint 开放测试 — OkConfusion6667 · 2026-09-25
- Reddit 用户仅调步数与 CFG 探索 AI 绘画的独立表达 — Extreme_Nice · 2026-09-25
- 不到 20 美元训练的 LoRA 让 Qwen-Image 单图转视角 — ben_burtenshaw · 2026-09-25
- Lingbot World v2 跑到 60 FPS,世界模型或重塑游戏开发 — bingxu_ · 2026-09-25