LlamaIndex 发布 ExtractBench:复杂企业文档信息提取基准
RexDouglass · x · 2026-08-16
LlamaIndex 创始人发布了 ExtractBench,这是一个针对复杂企业文档信息提取的综合基准。现有模型在长文档(如破产债权人名单)处理上常因注意力机制缺失或产生幻觉。基准覆盖了多种文档长度和字段密度(从单页到数百页,从几十到数万个字段),并定义了三种提取任务:大海捞针、密集文档和长列表。目标是推动模型在无需高昂单页成本(如 $1/页)的前提下,实现生产级的高精度提取。
所属事件:LlamaIndex 发布 ExtractBench 文档提取基准(2 条相关)→
「研究」频道最新
- DeepSeek 推出 LibTorch ABI 稳定版 FlashMLA — ezyang · 2026-08-18
- Mechanist 论文探索用 AI 发现智能机制 — ruthstarkman · 2026-08-18
- DeepMind 研究员反驳:AI 将革命所有自然科学 — DaniloJRezende · 2026-08-18
- 活体细菌制成的电路板:用分子传递信号 — NikoMcCarty · 2026-08-18
- 中国神经外科医生借 GPT-5.6 解决 22 年数学难题 — HealthcareAIGuy · 2026-08-18
- 研究者拟建“研究品味”Benchmark:挖掘选题直觉 — lateinteraction · 2026-08-18