Google 发布 Gemini 3.8 Live 双模型:语音对话可打断、97 语种实时切换
GoogleAI · x · 2026-09-16
Google AI 官方宣布推出迄今最先进的 Gemini 音频对话模型:Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking。
- 3.8 Live 主打规模、速度与成本:支持句中被打断后自然接续,可在 97 种语言间实时切换,并结合视觉上下文理解。演示场景是在 Search Live 中对着漏水的管道或断掉的自行车链条拍照,AI 逐步用语音指导修理。
- 3.8 Live Extended Thinking 面向复杂任务:边推理边说话、可并行处理,还会在执行过程中口述进度,适合策划活动等多步骤后台任务,同时保持对话不中断。
两个模型均已在 Gemini App 的 Gemini Live 中可用,开发者可通过 Gemini API(Google AI Studio)接入。
所属事件:谷歌发布 Gemini 3.8 Live 双模型:97 语种实时语音对话(11 条相关)→
「模型」频道最新
- OpenRouter 用户上周 OpenAI 消费反超 Anthropic,2.5 年来首次 — firstadopter · 2026-09-16
- 研究发现知识蒸馏在 mid-training 阶段牺牲事实记忆换推理 — LukeZettlemoyer · 2026-09-16
- DoorDash 等改用中国开源模型,闭源查询占比降至四分之一 — carlbfrey · 2026-09-16
- 阶跃星辰发布 StepAudio 3:5 款音频模型,ASR 达 1.7% WER — StepFun_ai · 2026-09-16
- 开源模型扛不住生产负载?Smaug Flash 称已修复卡死问题 — bindureddy · 2026-09-16
- ChatGPT 语音卡顿、Codex 报错,AGI 前的可靠性短板凸显 — koltregaskes · 2026-09-16