Opus 5 据称在 ARC-AGI-3 上以 30.2% 对 7.8% 领先
beffjezos · x · 2026-07-25
Beff Jezos 转述:Opus 5 在 ARC-AGI-3 上大幅领先
这条帖子引用了一组基准结果:Opus 5 在 ARC-AGI-3 上被称为击败了 GPT-5.6 Sol,成绩是 30.2% 对 7.8%。作者 beffjezos 顺带表示,希望能知道 Fable 在这条分数线上的位置。
帖子很短,但信息很直接:如果这个结果成立,那么不同顶级模型在该任务上的差距仍然非常大。
所属事件:Anthropic 发布 Claude Opus 5,多项基准领先且价格减半(73 条相关)→
「模型」频道最新
- LLaDA2.2 把多轮 Agent 真正瓶颈指向解码速度 — Direct_Band896 · 2026-07-25
- Opus 5 刻意避开 cyber 训练,却仍接近 Mythos 5 的找洞能力 — cedric_chee · 2026-07-25
- GPT-5.6 Sol 用力量流通关 Slay the Spire 进阶 6 — Jsevillamol · 2026-07-25
- Anthropic 称 Opus 5 是其迄今最对齐的模型 — Polymarket · 2026-07-25
- Claude Opus 5 综合登顶,Fable 5 仍领跑编程代理 — Hesamation · 2026-07-25
- Anthropic Opus 5 会在 59% 情况下写入结束对话理由 — Miles_Brundage · 2026-07-25