马斯克称 Grok 4.5 与 Opus 5 同列帕累托前沿
elonmusk · x · 2026-07-25
Elon Musk 发帖称,附图里的 FrontierCode 对比中,Grok 4.5 和 Claude Opus 5 是唯一站在帕累托前沿上的两个模型。
- 图表横轴是 每次 rollout 的平均成本,纵轴是 得分;Grok 4.5 和 Opus 5 位于最优权衡位置。
- 其余模型都落在前沿线下方,包括 Fable 5、GPT-5.6 Sol、Sonnet 5、Kimi K2.7、GLM 5.2、Composer 2.5 等。
- 这条帖子也给后续的 Grok 版本迭代铺垫了话题。
「模型」频道最新
- Claude 发布 Opus 5,称前沿级能力只要半价 — HuaxiuYaoML · 2026-07-25
- 发布博客预告:FrontierCode 智能体编码基准打平 — hardmaru · 2026-07-25
- 网友质疑 Anthropic 针对 ARC-AGI-3 评测进行特化训练 — VraserX · 2026-07-25
- Moonshot 开源权重 Kimi K3 逼近美国顶级模型,改写 AI 经济 — OmarUFlorez · 2026-07-25
- 黄仁勋首条推文力挺开源模型:世界需要前沿闭源与开源 — tech__unicorn · 2026-07-25
- Opus 5 在九项生物基准登顶,但仍有几项分析任务落后 — kenbwork · 2026-07-25