LightOn 开源 LightOnOCR-3:0.8B/1B/4B 三档全能文档模型
法国公司 LightOn 于 10 月 9 日发布文档智能模型家族 LightOnOCR-3,能力超出传统 OCR:单一模型可同时完成文字与手写识别、文档版面结构分析、图像描述以及图表数据提取。模型提供 0.8B、1B、4B 三种参数规模,全部采用 Apache 2.0 许可证开源,允许商用。
已确认
- 三个尺寸(0.8B、1B、4B)全部开源,协议为 Apache 2.0,可商用(多个帖子一致转述官方发布)。
- 单模型覆盖 OCR 转录、版面分析、图像描述、图表提取四类任务。
- 据 @wjbmattingly 转述,0.8B 与 4B 版本基于 Qwen3.5 视觉语言架构,支持空 prompt 用法。
尚未确认
- 榜单成绩细节仅见于 @IgorCarron 与 @wjbmattingly 的转述:称其在 OlmOCR-Bench 上领先 Chandra-O…(原文截断)并超过 Mistral OCR,具体分数与对比对象未完整给出,需以官方评测页为准。
为什么重要
- 过去文档处理流水线通常需要 OCR、版面分析、图表解析等多个模型串联,LightOnOCR-3 用一个开源模型统一这些能力,降低了部署与集成成本;Apache 2.0 加商用许可对企业和 RAG/文档智能化应用较为友好。
2026-10-09 ~ 2026-10-09 · 5 条相关
一手来源
- LightOnOCR-3 开源:0.8B/1B/4B 三档,OCR之外还能抽图表版面 — antoine_chaffin ·
- LightOn 发布 LightOnOCR-3:单模型搞定转录+版面,基准超 Mistral OCR — wjb_mattingly ·
- 【源头】LightOn 发布 LightOnOCR-3:单模型搞定转录+版面,基准超 Mistral OCR — wjb_mattingly · 2026-10-09
- 【源头】LightOnOCR-3 开源:0.8B/1B/4B 三档,OCR之外还能抽图表版面 — antoine_chaffin · 2026-10-09
- LightOn 发布 LightOnOCR-3 文档智能模型,开源权重榜单超 Mistral OCR — IgorCarron · 2026-10-09
另有 2 条近重复转述:IgorCarron · IgorCarron