CursorBench 4.0 榜单:Grok 4.7 得分 46.3% 且每任务仅 6 美元居性价比之首

haider1 · x · 2026-09-22

haider 分享 CursorBench 4.0 编程基准结果:Grok 4.7 xhigh 得分 46.3%、每任务成本 $6.01;Fable 5.1 medium 46.8%、$7.05;GPT-5.6 sol max 41.7%、$8.23。相比 Grok 4.6 xhigh 的 41.4%,新版本在成本几乎不变的情况下提升至 46.3%,性价比提升明显。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →