Grok 4.6 登顶 CursorBench,成本仅为竞品 1/6
XFreeze · x · 2026-08-22
Grok 4.6 在 CursorBench 3.2 中以 70.8% 的分数夺得第一,且效率惊人。其单任务成本为 $2.81,比 Fable 5 Max ($17.32) 低约 6 倍,比 Opus 5 Max ($8.23) 低近 3 倍。这种高智能与低算力消耗的结合,使其在需要长时间运行的智能体编码任务中极具优势。
「模型」频道最新
- Claude Security 现由 Mythos 5 驱动,支持跨文件漏洞追踪 — claudeai · 2026-08-22
- Ox Alpha 模型实测:在 Pi Harness 中表现惊艳 — omarsar0 · 2026-08-22
- LLM 生成诡异文本,疑是合成数据中的自我对话 — ctjlewis · 2026-08-22
- Ornith 1.5 35B上线RunInfra:缓存后输入约每百万$0.02 — alejandroll10 · 2026-08-22
- 开发者质疑 Ox-alpha 模型表现,或为营销噱头 — bindureddy · 2026-08-22
- SemiAnalysis 深度:开源模型正在追上闭源前沿模型吗? — JosephJacks_ · 2026-08-22