Vik Paruchuri:olmOCR-bench 已饱和,涨分靠对齐格式
VikParuchuri · x · 2026-10-10
Vik Paruchuri 表示团队使用 olmOCR-bench 一年多,认为它是该领域最公平一致的基准,但如今已饱和:剩余的大部分提升来自匹配其输出格式,而非更强的阅读能力。
所属事件:Datalab 发布开源 OCR 基准 OmniParseBench(5 条相关)→
「模型」频道最新
- 传 OpenAI 内部模型解 100+ 数学难题,产出 722 篇论文级成果 — haider1 · 2026-10-10
- 博主推测:Anthropic 半年前内部已有 Opus 5.5 级智能 — yihui_indie · 2026-10-10
- Nace AI 10B 以下决策模型 Drex v1.5 上架 OpenRouter — nischay_twt · 2026-10-10
- Claude Opus 4.6 贷款案例:真实环境中的顽固错配样本 — rgblong · 2026-10-10
- 博主建议在机器人模型预训练中加入 CUA 数据 — eigenron · 2026-10-10
- 传 Claude Opus 5.5 fast 模式上线 — kimmonismus · 2026-10-10