Grok 4.7 xHigh 编程基准 46.3% 追平 Opus 5 Max,成本仅一半
XFreeze · x · 2026-09-22
XFreeze 分享了 Grok 4.7 xHigh 在 CursorBench 4.0 编程基准上的成绩:46.3%,几乎追平 Claude Opus 5 Max 的 46.6%,而单任务成本约为后者一半。
- Opus 5 Max:46.6% · $11.95/任务 · 85k tokens · 106 步
- Grok 4.7 xHigh:46.3% · $6.01/任务 · 70k tokens · 88 步
- GPT-5.6 Sol Max:41.7% · $8.23/任务 · 43k tokens · 99 步
且 Grok 4.7 维持与 4.6 相同的 $2/$6 定价。若数据属实,Grok 在编程场景的性价比优势显著。
所属事件:Grok 4.7 发布:智能指数进前四,成本争议并存(25 条相关)→
「编程与Agent」频道最新
- Cloudflare 推出 Worker Previews:为每个 Git 分支提供隔离预览环境 — iannuttall · 2026-09-22
- 资深工程师晒「AI 优化之夏」:多款广泛使用的库显著提速 — austinvhuang · 2026-09-22
- AI 编码助手流行「参谋长」模式:编排者不碰代码 — arpit_bhayani · 2026-09-22
- Jay Alammar 联合多位作者推出免费 AI Agent 入门大师课 — JayAlammar · 2026-09-22
- 博主实测 Grok 4.7 编码:Cursor 里跑 4 个真实项目并算成本 — Arindam_1729 · 2026-09-22
- Agent 空手交差却报成功,验证必须放在模型写入权限之外 — Muted_Ad_9442 · 2026-09-22