法国开源 LightOnOCR-3 发布:0.8B/4B 双版本问鼎多个 OCR 基准
IgorCarron · x · 2026-10-09
法国公司 LightOn 发布 LightOnOCR-3 端到端文档理解模型家族,前代在 Hugging Face 下载量已超 450 万。核心信息:
- 能力:单次模型调用即完成文本/手写识别、版面元素定位(带标签与边界框)、图像描述、图表与科学图形数据提取;一个 prompt 切换纯转录与带定位的富输出两种模式
- 基准成绩:FRBench-pdf2md 第一(手写尤强),OlmOCR-Bench 第二(超过 Chandra-OCR-2、Mistral OCR 4.1、dots.mocr),开源权重模型中 ParseBench 第一
- 规格:0.8B 与 4B 两个版本,处理速度最高快一倍;输出为带标签和边界框的逻辑段落/标题/表格块,直接服务下游分块与检索
作者 Igor Carron 以「法国主权、开源、改变游戏规则的模型」调侃式推荐。模型已在 Hugging Face 开放。
所属事件:LightOn 开源 LightOnOCR-3:三尺寸模型问鼎 OCR 榜单(22 条相关)→
「模型」频道最新
- Grok 机器人一次成功 Amazon 下单,购物 agent Muse 两度失败 — jamesperkins · 2026-10-10
- Google AI Pro 订阅捆绑 Colab 权益:80GB A100 可全参微调 Gemma 31B — algo_diver · 2026-10-10
- 比人更聪明的模型,每百万 token 只收 0.1 美元 — dan_s_becker · 2026-10-10
- 马斯克演示 Grok 可为任意主题生成模拟场景 — elonmusk · 2026-10-10
- Burkov断言:仅靠模型本身永远无法解决幻觉问题 — burkov · 2026-10-10
- 4GB 显存 10 分钟微调:Qwen3.5 0.8B 决策模型准确率 37% 升至 65% — danielhanchen · 2026-10-10