语音盲测 Arena:Gemini 3.8 Live Elo 1083 排第二
ArtificialAnlys · x · 2026-09-16
Artificial Analysis 补充 Speech Agent Arena 数据:在盲测实时语音对话偏好中,Gemini 3.8 Live 以 Elo 1083 首秀即排第 2,仅次于上一代 Gemini 3.1 Flash Live(1096),领先 GPT-Live-1 (Sol) 的 1053;任务成功率 93.2% 排第 2,次于 Grok Voice Think Fast 2.0 High 的 94.6%。Extended Thinking (High) 变体为 Elo 990、成功率 89.1%。
所属事件:Gemini 3.8 Live 语音基准全面登顶且价格最低(6 条相关)→
「模型」频道最新
- GPT-6 自主修好《辐射3》著名 NPC 对话卡死 bug — imjustnewatai · 2026-09-16
- ChatGPT 联合发明人称新模型 Jev 快 20-200 倍、便宜 40-400 倍 — hardimanjames · 2026-09-16
- 百万上下文窗口虽香,账单能把人「烧伤」 — peterjliu · 2026-09-16
- 曝开源权重模型疑似大量蒸馏 OpenAI 与 Anthropic,训练代码缺失是佐证 — dan_s_becker · 2026-09-16
- 研究发现多个科学类 LLM 基准答案有错,修正后模型分数显著上升 — Profanion · 2026-09-16
- Scott Aaronson 称听闻 AI 公司已攻克多个理论计算机科学悬而未决难题 — scaling01 · 2026-09-16