Datalab 发布 OmniExtractBench,修正文档抽取评测偏差
Vik Paruchuri(Marker/Surya 作者、现任 Mistral OCR 负责人)团队与 Paul Scemama 合作推出文档抽取评测基准 OmniExtractBench。现有 benchmark 普遍存在偏差及评分或真值问题,新基准整合了 ExtractBench(LlamaIndex)、LongExtractionBench 等多源数据并统一口径,覆盖 620 份文档,代码开源,旨在修正既有评测的严重计分缺陷,公平比较各参评模型的文档信息抽取能力。
2026-09-17 ~ 2026-09-17 · 4 条相关
- Datalab 推出 OmniExtractBench:620 份文档纠正文档抽取评测偏差 — VikParuchuri · 2026-09-17
- VikParuchuri 团队统一口径实测文档抽取,多源基准合并并开源代码 — VikParuchuri · 2026-09-17
- Marker 作者自建文档抽取评测基准,修正既有基准的严重计分缺陷 — VikParuchuri · 2026-09-17
- Mistral OCR 作者联手发布文档抽取基准,直指现有评测盲区 — VikParuchuri · 2026-09-17