曝 Google 发布 Gemini 3.8 Live:实时语音边想边说可同步推理
xiaohu · x · 2026-09-16
中文博主称 Google 发布 Gemini 3.8 Live 与 Extended Thinking 版本,将实时语音推向多步骤推理(未获官方证实,Gemini 3.8 命名存疑,请谨慎对待)。
- 基础版:主打高并发、低延迟、高性价比,支持 97 种语言自动识别与平滑过渡,兼顾视觉+语音多模态实时互动。
- Extended Thinking 版:面向企业级复杂任务,强化多步骤推理与规划;「实时思考与发音同步」,复杂问题会自然说出过渡语并同步汇报后台任务进度。
- 后台异步工具调用:调用 API、检索、订座时语音对话不中断。
- 近实时视觉理解:可边看画面边聊天,如看棋盘下棋、看草图语音沟通并生成 React 代码。
所属事件:Google 发布 Gemini 3.8 Live 实时语音对话模型(24 条相关)→
「模型」频道最新
- 多名用户收到 Anthropic 用量退款邮件,官方终于给出解释 — Darpinian · 2026-09-16
- 繁体中文视觉基准 VisTW:你的 VLM 读得懂台湾街景和考卷吗 — piske_usagi · 2026-09-16
- 无需推理轨迹也能蒸馏领域专家模型,隐式路径决定泛化 — Yilei Tu · 2026-09-16
- Claude Opus 5 写 PR 会主动「自曝」开发中犯的所有错误 — repligate · 2026-09-16
- DeepSeek V4.1 Flash 单次生成潜艇 3D 模型,零素材纯代码建模 — teortaxesTex · 2026-09-16
- 不到十人团队训练 27B 安全模型,CyberGym 成功率 63% 逼近 Claude — 新智元 · 2026-09-16