Marker 作者自建文档抽取评测基准,修正既有基准的严重计分缺陷

VikParuchuri · x · 2026-09-17

VikParuchuri(Marker/文档解析工具作者)团队发布了新的文档抽取评测方法,整合了 ExtractBench(LlamaIndex)、LongExtractionBench(Reducto)、LongArray(Extend)及自建基准的文档,并制定了统一规则(如 null 字段与行匹配的判定标准)。\n\n他们指出既有基准存在大量错误:例如同样的表格错误数量在 LongExtractionBench 中可能得 100% 也可能得 0%。评测代码与数据均已开源。

所属事件:Datalab 发布 OmniExtractBench,修正文档抽取评测偏差(4 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →