LlamaIndex 实测 Fable 5.1:文档 OCR 各项指标全面超越上代
llama_index · x · 2026-09-03
Fable 5.1 发布时未附文档 OCR 成绩,LlamaIndex 团队遂用自建的 ParseBench(覆盖金融、法律、保险等领域的 2000+ 真实文档)对其进行了评测。
主要结论:
- Fable 5.1 在表格、内容忠实度、格式、图表、视觉定位等全部指标上超越 Fable 5,是近期少见的在文档解析上真实进步的代际升级;
- 它是当前表格解析最强的模型之一;
- 作者指出前沿模型近年推理成绩快速提升,但视觉理解任务上(Opus 5、5.6-Sol、3.7 Flash 等)长期停滞,Fable 5.1 打破了这一趋势。
作者同时提醒:不宜把 Fable 5.1 单独当文档 OCR 工具使用,仍缺生产所需的配套能力。
「模型」频道最新
- 用户实测 Flash 3.8:能力出色但会陷入静默死循环烧 token — brandon_galang · 2026-09-03
- 用户吐槽 Claude Max 20x 限额不清:周限额才是真瓶颈,发帖被删 — conorearly · 2026-09-03
- 用户吐槽 Gemini 3.8 Flash 退化:Agent 任务反不如 3.7 — Scobleizer · 2026-09-03
- Muse Spark 1.3 生成可交互 3D 日式庭院,Scale CEO 盛赞大跃升 — alexandr_wang · 2026-09-03
- AI 竞预测榜惊现「DeepSeekV5-Preview」,网友直呼离谱 — teortaxesTex · 2026-09-03
- 用户实测 Gemini 3.8 Flash 表现稳健但多次陷入无限循环 — brandon_galang · 2026-09-03