HF 上 41 个 OCR 模型分四类整理:覆盖漫画、手写与多语种
vanstriendaniel · x · 2026-09-07
Hugging Face 用户 davanstrien 将 Hub 上的 OCR 资源整理成 4 个合集、共 41 个模型,附简短实用说明:
- Documents(17 个):扫描页、书籍、表格、公式的实用 OCR 与文档解析模型,按近期发布与使用度排序
- Languages & scripts(10 个):面向泰语、日语、越南语、阿拉伯语、韩语、天城文等特定语言/文字的整页读取器与文本行识别器
- Handwriting & archives(10 个):手写与历史印刷识别,含瑞典语、挪威语、德语 Kurrent、藏文、希伯来文手稿,多数需裁剪后的文本行输入
- Text recognition & pipelines:文本行与区域识别及完整 OCR 管线
涵盖 VLM、专用识别器和完整 pipeline,适合按场景选型。
「模型」频道最新
- Reddit 热议:前沿模型领先本地模型仅约 6 个月 — Anxious_Current2593 · 2026-09-08
- ChatGPT 检索系统泄露:一次提问暗跑 18 条隐藏查询调 50 次引擎 — metehan777 · 2026-09-08
- 用户喊话 Anthropic:Fable 5.1 再好,也想要回正常说话的 Opus — james_mtc · 2026-09-07
- 用户观察:Astra 对 skills 中严格规则的遵从不如 Sol — petergyang · 2026-09-07
- 实测 Astra 事实核查:仍会产出大量不相关的「假批评」 — AndyMasley · 2026-09-07
- MLP 在聚类回归中自发学习单义神经元论文引关注 — burkov · 2026-09-07