Claude Opus 5 登顶 BenchmarkList 成为新全球 SOTA
davidthesong · reddit · 2026-07-25
Claude Opus 5 的 BenchmarkList 截图显示,它被标为新的 全局 SOTA 第 1 名,实验性 ECI 评分为 154.80,并覆盖 52 个基准。
- 页面把 Opus 5 排到 372 个模型中的第 1 位。
- 图中展示它在 agentic、编程与软件、文档 AI、数学、多语言 等类别上表现强势。
- 截图还标注它来自 Anthropic,为 API-only,价格显示为 每 100 万 token 输入 $5 / 输出 $25。
所属事件:Claude Opus 5 多榜单登顶成新 SOTA(5 条相关)→
「模型」频道最新
- Anthropic 这次“chart crime”更像过度信任 Claude — herbiebradley · 2026-07-25
- Claude Opus 5 在同仓库修出 11 个 bug,Opus 4.8 只修 2 个 — PawelHuryn · 2026-07-25
- Miles Brundage:Anthropic 图表争议本质是过度信任 Claude — Miles_Brundage · 2026-07-25
- 一张评测图表因数字混乱变成 AI 圈梗图 — Miles_Brundage · 2026-07-25
- FrontierCode 1.1 显示 Opus 5 在更强推理下反而降分 — andrew_n_carr · 2026-07-25
- Bug Hunt Bench 实测:GPT-5.6 Sol 修复 22 个 bug,Opus 5 修复 12 个 — PawelHuryn · 2026-07-25