Google 推出 3.8 Live 语音模型,覆盖 API 与 Gemini 全家桶
tulseedoshi · x · 2026-09-24
作为语音产品线的延续,Google 一周前发布了 SOTA 3.8 Live 和 3.8 Live Thinking 模型,面向大规模构建更智能的语音 agent,示例包括编码伙伴场景。模型可通过 API、Gemini Enterprise、Gemini Live、Search Live、Docs Live 等渠道使用,官方预告还有更多功能在路上。
所属事件:Google 发布 Gemini 3.8 Flash TTS 双模型,30 秒克隆声音(27 条相关)→
「多模态」频道最新
- 开源数据集 FineVision 获 NeurIPS 接收:17M 图、200 余源 — andimarafioti · 2026-09-25
- MiniMax H3 疑似「微笑过拟合」: bored 毛毛虫视频翻车实录 — episodex86 · 2026-09-25
- 浏览器端 3D 姿势编辑器 Pose Blueprint 开放测试 — OkConfusion6667 · 2026-09-25
- Reddit 用户仅调步数与 CFG 探索 AI 绘画的独立表达 — Extreme_Nice · 2026-09-25
- 不到 20 美元训练的 LoRA 让 Qwen-Image 单图转视角 — ben_burtenshaw · 2026-09-25
- Lingbot World v2 跑到 60 FPS,世界模型或重塑游戏开发 — bingxu_ · 2026-09-25