Grok 4.7 编程 Agent 指数 47→56,三项子基准全面上升

ArtificialAnlys · x · 2026-09-22

Artificial Analysis 补充 Grok 4.7 编程能力细节:配合自家 Grok Build 编程 Agent,Grok 4.7 (xhigh) 在 Coding Agent Index 得分 56,较 Grok 4.6 (xhigh) 的 47 提升 9 分,三个组成部分均改善——DeepSWE v1.1 从 65% 升至 73%,Terminal-Bench 4.0 从 18% 升至 33%,SWE-Atlas-QnA 从 58% 升至 63%。该评测使用 xAI 第一方 harness,与 Intelligence Index 的标准化跨模型评测分开。

所属事件:Grok 4.7 评测:智能指数46分进前四,token消耗翻倍(7 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →