Claude Opus 5 多榜单登顶成新 SOTA
Claude Opus 5 在最新曝光的多个第三方基准测试榜单中表现出色,综合能力登顶成为新的全局 SOTA(当前最优模型)。在 Artificial Analysis 和 BenchmarkList 的评测中,它均超越了 Claude Fable 5 等竞品,引发了社区的广泛关注。
已确认
根据 Artificial Analysis 更新的榜单,Claude Opus 5 在 Intelligence Index 上获得了 61 分,综合排名登顶,略高于 Claude Fable 5。不过,@Hesamation 指出在编程代理(Coding Agent)细分能力上,Fable 5 依然保持领先。此外,@davidthesong 提供的 BenchmarkList 截图显示,Claude Opus 5 被标记为新的全局 SOTA 第 1 名,其覆盖了 52 个基准,实验性 ECI 评分为 154.80。
为什么重要
Claude Opus 5 在综合智能指数上的登顶,标志着大模型能力天花板的再次提升。同时,Opus 5 与 Fable 5 在通用能力与编程代理任务上的差异化表现,为开发者在不同应用场景下的模型选择提供了明确的参考依据。
2026-07-25 ~ 2026-07-25 · 5 条相关
- 第 1 集:Anthropic 模型发布陷混乱,Opus 5 被指关乎成败(2026-07-23,2 条)
- 第 2 集:Anthropic 发布 Claude Opus 5,编码能力达 SOTA(2026-07-25,79 条)
- 第 3 集:网传 Anthropic 发布 Opus 5,支持加速与科研顶配(2026-07-25,3 条)
- 第 4 集:Claude Opus 5 早期反馈:编码强但破坏旧工作流(2026-07-25,5 条)
- 第 5 集:Anthropic 称 Claude Opus 5 刻意限制网络安全训练(2026-07-25,5 条)
- 第 6 集:Claude Opus 5 多榜单登顶成新 SOTA(2026-07-25,5 条)
- 第 7 集:Claude Opus 5 刷新 ARC-AGI-3 纪录并展现代数推理(2026-07-25,6 条)
- 第 8 集:Claude Opus 5 中等推理模式编码性能最佳(2026-07-25,5 条)
- 第 9 集:Claude Opus 5 视觉评测落后且成本高昂(2026-07-25,4 条)
- 第 10 集:Claude Opus 5 提供五档推理强度并默认开启(2026-07-25,2 条)
一手来源
- Claude Opus 5 综合登顶,Fable 5 仍领跑编程代理 — Hesamation ·
- Claude Opus 5 登顶 BenchmarkList 成为新全球 SOTA — davidthesong ·
- Claude Opus 5 在模型能力图上位居前列 — scaling01 ·
- Artificial Analysis 榜单显示 Claude Opus 5 领先 Fable 5 — Leonardo-editing · 2026-07-25
- 【源头】Claude Opus 5 在模型能力图上位居前列 — scaling01 · 2026-07-25
- 【源头】Claude Opus 5 综合登顶,Fable 5 仍领跑编程代理 — Hesamation · 2026-07-25
- 【源头】Claude Opus 5 登顶 BenchmarkList 成为新全球 SOTA — davidthesong · 2026-07-25
- Claude Opus 5 在 Artificial Analysis 上略胜 Claude Fable 5 — thesaraharminta · 2026-07-25