olmOCR-bench is saturated, so Datalab built auditable OmniParseBench: 16,288 tests, 92 languages

VikParuchuri · x · 2026-10-10

Datalab released OmniParseBench: 16,288 pass/fail tests on 2,937 pages from 2,343 documents across 92 languages, with open data and scorer code. It exists because olmOCR-bench has saturated — remaining gains reflect format matching, not reading — and ParseBench's per-capability metrics share no common unit. Every test is auditable, tagged, and explorable by slice.

Related event: Datalab Releases OmniParseBench, an Open OCR Benchmark It Doesn't Top(5 posts)→

Original post →

More from Models

Models channel →