Opus 5 据称在 SimpleBench 上排第二,只差 Fable 1%
Calm_Hedgehog8296 · reddit · 2026-07-25
这是一条关于 Opus 5 的简短补充,称它在 SimpleBench 上排到第二名,落后 Fable 1%、落后人类 3%。
帖子更像是一个补充 benchmark 结果,和前面那条 Opus 5 发布/对比内容高度重合,因此不再重复打通知标签。
所属事件:Anthropic 发布 Claude Opus 5,多项基准测试领先(64 条相关)→
「模型」频道最新
- 前端测试里,GPT-5.6 的落地页质感胜过 Claude Opus 5 — Arindam_1729 · 2026-07-25
- Claude Opus 5 疑似曝光:具备自我纠错与执行能力 — mathemagic1an · 2026-07-25
- Google 因 Gemma 表现和开源立场遭质疑 — BoogerheadCult · 2026-07-25
- 马斯克称 Grok 4.6 两周后、4.7 四周后发布 — elonmusk · 2026-07-25
- Together 称 Kimi K3 以 35% 价格逼近 Claude Fable 5 编码能力 — togethercompute · 2026-07-25
- 马斯克称 Grok 4.5 与 Opus 5 同列帕累托前沿 — elonmusk · 2026-07-25