LlamaIndex 开放 ParseBench/ExtractBench,暗讽对手封锁竞争
llama_index · x · 2026-09-05
LlamaIndex 创始人 Jerry Liu 发文表示,与 OCR 赛道其他玩家不同,LlamaIndex 不会阻止竞争对手访问其平台,并持续投入开放、可复现的文档解析与抽取基准建设。
- ParseBench(文档解析)与 ExtractBench(信息抽取)均为完全开放的长期维护基准,持续加入新模型,如 3.8 flash、fable 5.1、r-1 等
- 目标是让行业看清准确率与成本的帕累托前沿如何随时间演进
- 团队承认基准会出错,并接受社区反馈修正
- 两个基准均提供 GitHub/HuggingFace 访问入口
文中还顺带为其生产级文档 OCR 服务做了推广,整体是对 OCR 基准开放性的行业站队表态。
「模型」频道最新
- 用户吐槽 GPT-6 Astra 频繁忘记自己会用电脑和 Gmail MCP — Soft_Hand_1971 · 2026-09-05
- Eric Horvitz:Astra 模型卡显示通过思维链监控滥用正越来越难 — erichorvitz · 2026-09-05
- GPT-6 Astra 登陆 Databricks,主打智能体推理与企业文档处理 — matei_zaharia · 2026-09-05
- 网传 Astra 模型 Runescape 基准爆发,16 项技能破 10 项纪录 — scaling01 · 2026-09-05
- 两个月前被捧为 AGI 的编码模型,对比 GPT-6 Astra 高下立现 — aidan_mclau · 2026-09-05
- 网传 GPT-6 Astra 网安基准刷榜:29/32 CVE,三次测试花费近 4000 美元 — charliermarsh · 2026-09-05