Why does GPT 5.6 Terra beat Astra on the APEX-1 leaderboard?

zainhas · x · 2026-09-09

zainhas questions Mercor's APEX-1 leaderboard, where GPT 5.6 Terra ranks above Astra, and GPT 5.4 outscores Fable 5 while tying Gemini 3.6 Flash—results that clash with common expectations. APEX-1 tests models on realistic tasks from four professions: investment banking, consulting, big law, and primary care.

Related event: Mercor's APEX-1 Benchmark Released, Rankings Draw Skepticism(2 posts)→

Original post →

More from Models

Models channel →