Google 发布 Gemini 3.8 Flash TTS 语音生成模型,主打动态声音创作
dioscuri · x · 2026-09-24
Google AI Studio 宣布推出两款新的 Gemini 3.8 文本转语音模型,把语音生成从静态预设升级为「动态创作工作室」,面向创作者与开发者。
有趣的传播细节:fofrAI 用「走神的 ASMR」风格演绎了这条 TTS 发布公告,展示新模型的表现力。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(27 条相关)→
「多模态」频道最新
- 开源数据集 FineVision 获 NeurIPS 接收:17M 图、200 余源 — andimarafioti · 2026-09-25
- MiniMax H3 疑似「微笑过拟合」: bored 毛毛虫视频翻车实录 — episodex86 · 2026-09-25
- 浏览器端 3D 姿势编辑器 Pose Blueprint 开放测试 — OkConfusion6667 · 2026-09-25
- Reddit 用户仅调步数与 CFG 探索 AI 绘画的独立表达 — Extreme_Nice · 2026-09-25
- 不到 20 美元训练的 LoRA 让 Qwen-Image 单图转视角 — ben_burtenshaw · 2026-09-25
- Lingbot World v2 跑到 60 FPS,世界模型或重塑游戏开发 — bingxu_ · 2026-09-25