LlamaIndex 推出 ExtractBench:覆盖 8 大领域 4869 页复杂文档
llama_index · x · 2026-08-12
LlamaIndex 创始人 Jerry Liu 发布了 ExtractBench,旨在评估复杂企业文档的信息提取能力。
基准特点:
- 规模与多样性:包含 4869 页文档,覆盖金融、能源、医疗、法律等 8 个真实业务领域,共计 67 种文档类型。
- 复杂边缘场景:涵盖长短不一的文档,并包含极具挑战性的表格(如超 1000 行的表格、嵌套表格、跨页表格)以及扫描件、手写体和旋转页面。
评估结果:
研究团队对 14 种不同的视觉语言模型(VLM)、编程智能体和文档提取 API 进行了测试。发现尽管当前前沿模型在编程和知识工作上表现优异,但在生产环境的复杂文档提取中依然吃力。优秀的提取器必须在不丢行的情况下解析多页文件,提供精确的空间引用以满足审计需求,并控制 token 成本以支持海量文档处理。
所属事件:LlamaIndex发布企业复杂文档提取基准ExtractBench(4 条相关)→
「模型」频道最新
- 网友期待 Claude V4 Pro 本周发布,此前延期至7月底 — teortaxesTex · 2026-08-12
- Gemini 犯晕:把自己的创造者当成了 OpenAI — Ancient-Tomato-5226 · 2026-08-12
- 告别高昂算力:直接在浏览器从零训练真实语言模型 — chrisgrayson · 2026-08-12
- Claude Opus 5 被指频繁混入英式拼写 — ericm272 · 2026-08-12
- 安全护栏误伤:模型因关键词触发拦截阻碍Bug修复 — xeophon · 2026-08-12
- Mitsuhiko担忧:闭源大模型或全面封禁Assistant Prefill — mitsuhiko · 2026-08-12