Grok 4.5 被拿来比性价比

rohanpaul_ai · x · 2026-07-18

这条帖用 Artificial Analysis 的 Intelligence Index 任务成本来比较 Grok 4.5 的性价比。

核心结论是:

帖中还提到 token 消耗数据:Grok 4.5 在 FrontierSWE 上使用的 token 数接近比 Fable 5 少 6 倍,但仍保持在排行榜前列。

作者的判断是,对很多真实应用来说,“每完成一个任务的成本”比单纯领先一点 benchmark 更重要,因为它直接影响:

因此,前沿模型竞争的衡量标准应该从“原始智能”转向“高效智能”。

所属事件:Grok 4.5 低成本高效率引热议(10 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →