Claude Opus 5 在 ARC-AGI-3 上得分达到第二名的三倍
claudeai · x · 2026-07-25
Anthropic 表示,Claude Opus 5 在强调新问题求解能力的 ARC-AGI-3 上,得分是次优模型的 3 倍。
配图还把成绩放到成本维度下比较,强调它在相近甚至更低的单任务成本下依然具备很强表现。
所属事件:Anthropic 发布 Claude Opus 5,性能达新 SOTA 且价格减半(25 条相关)→
「模型」频道最新
- Anthropic 称 Opus 5 以半价逼近 Fable 5 基准表现 — dotey · 2026-07-25
- Opus 5 价格涨约 15%,但仍被视为 4.8 的严格升级 — bindureddy · 2026-07-25
- Fable 5.1 预计晚于 GPT-6,发布时间指向 8 月下旬到 9 月中旬 — zephyr_z9 · 2026-07-25
- ARC-AGI-3 图表显示 Opus 5 领先,但评测成本更高 — Angaisb_ · 2026-07-25
- Opus 5 比 4.8 明显更强,但“灵光”仍不如 Fable 5 — bindureddy · 2026-07-25
- 一张首发图把 53.4 画得像比 53.5 更强 — op7418 · 2026-07-25