Claude Opus 5 scores 30.2% on ARC-AGI-3 public demo environments

GregKamradt · x · 2026-07-25

ARC Prize says Anthropic’s Fable-class models score about 20% on the ARC-AGI-3 public demo environments, while Claude Opus 5 reaches 30.2%.

The post says the gap appears to come from stronger logical reasoning, which in turn enables more autonomous exploration, planning, and execution in unfamiliar environments.

Related event: Claude Opus 5 Sets New Record on ARC-AGI-3(4 posts)→

Original post →

More from Models

Models channel →