Grok 4.5 被拿来比性价比
rohanpaul_ai · x · 2026-07-18
这条帖用 Artificial Analysis 的 Intelligence Index 任务成本来比较 Grok 4.5 的性价比。
核心结论是:
- Grok 4.5 的单任务成本约为 $0.31
- 相比 Claude Fable 5 约便宜 9 倍
- 相比 Claude Opus 4.8 约便宜 6 倍
- 相比 GPT-5.6 Sol 或 Kimi K3 约便宜 3 倍
帖中还提到 token 消耗数据:Grok 4.5 在 FrontierSWE 上使用的 token 数接近比 Fable 5 少 6 倍,但仍保持在排行榜前列。
作者的判断是,对很多真实应用来说,“每完成一个任务的成本”比单纯领先一点 benchmark 更重要,因为它直接影响:
- agent 成本
- 使用额度
- 测试速度
- 大规模部署后的利润率
因此,前沿模型竞争的衡量标准应该从“原始智能”转向“高效智能”。
所属事件:Grok 4.5 低成本高效率引热议(10 条相关)→
「模型」频道最新
- 传 OpenAI 在 Astra 中使用 neuralese 循环变换器,新的 scaling 轴浮出水面 — imadade · 2026-09-03
- XBOW 团队拿下今年首个 Chrome 全链漏洞利用奖励 — moyix · 2026-09-03
- Gemini 3.8 Flash 的 Pareto 最优地位仅维持了 5 小时 18 分钟 — alejandroll10 · 2026-09-03
- 双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash — kuhunaxeyive · 2026-09-03
- Anthropic 商务智能体只建购物车交人工结账,被赞退款风控思路对 — HaktanSuren · 2026-09-03
- Qwen3.8 27B Q8 翻车:12 万 token 后发现根本没读计划,自行实现别的功能 — KingCpzombie · 2026-09-03