Claude Opus 5 在 ARC-AGI-3 得分 30.2%,远超此前 7.8%
mhmazur · x · 2026-07-25
ARC Prize 相关信息显示,Claude Opus 5 在 ARC-AGI-3 上刷新了新的 SOTA。
- 其得分为 30.2%。
- 之前的最高分只有 7.8%,由 GPT-5.6 Sol(Max)保持。
- ARC Prize 还提到,Opus 5 展现出一些新行为,帮助它解出了此前没有模型攻克过的环境,分析里甚至超过了 Fable。
这是一条典型的模型评测进展消息,核心看点是分数跃升幅度非常大。
「模型」频道最新
- 有人直言 Gemini 3.5 Pro 已经太晚难竞争 — teortaxesTex · 2026-07-25
- Anthropic 称 Claude Opus 5 以半价逼近前沿模型 — eyishazyer · 2026-07-25
- AutomationBench 图表显示 Opus 5 更强于长程智能体任务 — daniel_mac8 · 2026-07-25
- Claude Opus 5 进入 GitHub Copilot 和 Microsoft Foundry — DanWahlin · 2026-07-25
- CursorBench 3.2 显示 Claude Opus 5 仅落后 Fable 5 0.5 分,成本减半 — EricBuess · 2026-07-25
- Hyperagent:Opus 5 更强,但 GPT-5.6 Sol 更便宜更好落地 — TawohAwa · 2026-07-25