Unlimited-OCR 一次读完整份 PDF
Shruti_0810 · x · 2026-07-20
中国团队开源了 Unlimited-OCR,一个 30 亿参数的 OCR 模型,主打“一次读完整份文档”。
- 使用 32K 上下文窗口,不再按页切分处理
- 能保留跨页上下文,对表格、引用、长文档更友好
- 在标准 OCR 基准上做到 93%,比基线高约 6 分
- 40 页以上的错误率据称 低于 0.11
- 支持 Transformers、vLLM、Ollama、Docker、llama.cpp 等,本地即可运行
原帖强调,这种做法比很多仍按页处理的企业 OCR 系统更可靠,而且下载后本地使用不需要按页付费。
所属事件:百度开源Unlimited-OCR长文档识别模型(4 条相关)→
「多模态」频道最新
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11
- ComfyUI 新节点发现器上线:按 star 增速过滤最新热门节点 — Luke2642 · 2026-09-11
- 用 MiniMax H3 MAX 对一只蚊子放大招,蚊子毫发无伤 — Hailuo_AI · 2026-09-11