两个月成绩翻三倍:Grok 登顶 Terminal-Bench 4.0 超 GPT-5.6 Sol

ns123abc · x · 2026-09-22

据推文,Grok 在 Terminal-Bench 4.0(终端/agent 编码基准)上的成绩在两个月内从 12.4% 涨到 38.0%,翻了三倍,并超越了 GPT-5.6 Sol。若数据属实,这是 xAI 模型在 agent 编码任务上进步速度的又一例证。

所属事件:Grok 4.7 登顶 Terminal-Bench 4.0 两个月成绩翻三倍(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →