Tau Voice 榜 Gemini 3.8 Live 登顶 68.6%,近翻倍于上一代
ArtificialAnlys · x · 2026-09-16
Artificial Analysis 补充 Agent 能力数据:Gemini 3.8 Live Extended Thinking (High) 以 68.6% 登顶 Tau Voice 语音 Agent 基准,超过 GPT-Live-1 (Astra) 的 67.9%、GPT-Live-1 (Sol) 的 59.3% 和 Grok Voice Think Fast 2.0 High 的 56.5%,而上一代 Gemini 3.1 Flash Live High 仅 37.7%。同时,Speech Agent Arena 盲测中标准版以 Elo 1083 排第 2,任务成功率 93.2%。
所属事件:Gemini 3.8 Live 语音基准全面登顶且价格最低(6 条相关)→
「模型」频道最新
- 用户指控 OpenAI 静默降级「可疑」账户的模型质量 — LiquidVolatility · 2026-09-16
- 传 OpenAI 内部模型分三档:Terra 定位尴尬恐被砍 — kevinkern · 2026-09-16
- IFM 7B 小模型 K2-Horizon 逼近 27B 水准,训练全流程开源 — karminski3 · 2026-09-16
- Salesforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super — NVIDIA Blog · 2026-09-16
- 新模型走出隐身:不能聊天,号称比 LLM 快且便宜百倍 — hardimanjames · 2026-09-16
- 对比 OpenAI 条款话术,分析师认为 Meta 更可能真正排除用户数据训练 — ivan_bezdomny · 2026-09-16