Grok 4.5 成本效率碾压对手
XFreeze · x · 2026-07-18
Grok 4.5 的效率表现被称为“离谱”:在 Artificial Analysis 的 Intelligence Index 任务上,单次成本约 $0.31,同时仍能给出前沿级智能表现。
对比数据里,Claude Fable 5(max)约 $2.75、Claude Opus 4.8(max)$1.80、GPT-5.6 Sol(max)$1.04、Kimi K3 $0.95。也就是说,Grok 4.5 大约比 Fable 5 便宜近 9 倍、比 Opus 4.8 便宜近 6 倍、比 Kimi K3 便宜约 3 倍。
在 FrontierSWE 上,它每个任务还用了接近 Fable 5 6 倍更少的总 token,却依然排在非常靠前的位置。作者的结论是:SpaceXAI 已经把“高智能 + 极高 token 效率”结合起来了。
所属事件:Grok 4.5 低成本高效率引热议(10 条相关)→
「模型」频道最新
- AxiomProver登顶LeanEval,末个未饱和数学形式化基准 — BenBlaiszik · 2026-09-03
- Muse Spark 1.3 把用户叫成 Judah 后又死不承认 — fragment_me · 2026-09-03
- 用户实测:Google AI Mode 对 TOFU 类查询完全不给出处引用 — gaganghotra_ · 2026-09-03
- 评测称 Fable 5.1 失败率减半:每百次仅 7 次失败、幻觉率 0.7% — ryanshrout · 2026-09-03
- Seroter 每日阅读清单:Gemini 3.8 Flash、agent 遥测与 7 种 skill 模式 — rseroter · 2026-09-03
- 爆料称 OpenAI Astra 有两个测试版,主打长时自主任务 — Ok_Display_3159 · 2026-09-03