曝 Grok 4.6 登顶 CursorBench 真实编程测试
kevinnbass · x · 2026-08-14
据推文爆料,Grok 4.6 在 CursorBench 3.2 真实编程能力测试中位列第一,超越了 Claude Fable 5、Opus 5 和 GPT-5.6 Sol。
该推文强调,Grok 4.6 不仅在性能上达到前沿水平,其单任务成本效率也极具优势,展现出惊人的编程实力。
所属事件:Grok 4.6登顶编程测试且性价比远超竞品(3 条相关)→
「模型」频道最新
- GLM-5.3能力提升全靠后训练,与5.2同基座 — cedric_chee · 2026-08-14
- 对 Claude 大写咆哮将消耗更多 Token — keunwoochoi · 2026-08-14
- 智谱GLM-5.3模型将于两周内开源,编码能力大幅提升 — cedric_chee · 2026-08-14
- Dharmamitra弃用Gemini与Claude,转向自研托管模型 — SebastianNehrd2 · 2026-08-14
- 传 GLM-5.2 性能提升全靠后训练,基础模型未变 — ivan_bezdomny · 2026-08-14
- Reddit开发者实测:用DeepSeek打造超长记忆AI跑团DM,两周成本不到2美元 — zacurryy · 2026-08-14