Grok 语音模型以 94.6% 任务成功率登顶语音智能体竞技场

XFreeze · x · 2026-09-17

Artificial Analysis 的 Speech Agent Arena 榜单上,xAI 的 Grok Voice "Think Fast 2.0" 以 94.6% 的任务成功率排名第一,领先 Gemini 3.8 Live、GPT-Realtime-2.1 High 等语音模型。

该基准测试的真实性在于:由真人隐藏身份与各语音智能体对话完成实际任务,再检验模型是否理解请求、调用正确工具并真正完成任务——考察的是「把事办成」而非「像人说话」。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →