Epoch AI unveils FrontierMath Erdős: pre-release Astra solves only 2 of 68

Chris-MelodyFirst · reddit · 2026-09-04

Epoch AI announces FrontierMath Erdős, a new 68-problem benchmark. A pre-release Astra solved 2 of 68, while GPT-5.6 Sol, GPT-5.5, Claude Fable 5.1 and Claude Fable 5 all failed on every attempt, making it by far the hardest math benchmark for frontier models. Details in Epoch AI's announcement.

Related event: Epoch AI Launches FrontierMath Erdős Benchmark; GPT-6 Astra Is Only Model to Score Above Zero(10 posts)→

Original post →

More from Research

Research channel →