LightOn 发布 LightOnOCR-3:单模型搞定转录+版面,基准超 Mistral OCR
wjb_mattingly · x · 2026-10-09
LightOn 发布文档智能模型家族 LightOnOCR-3,提供 0.8B、1B、4B 三个尺寸(0.8B 与 4B 采用 Qwen3.5 视觉语言架构),Apache 2.0 开源,可商用:
- 单模型双能力:空 prompt 时转录整页;用 grounding 作 prompt 则输出带标签的边界框、图片描述与图表数据表格,可替代复杂文档理解流水线
- 基准领先:在 OlmOCR-Bench 上超过 Chandra-OCR-2、Mistral OCR 4.1 和 dots.mocr;开源权重模型中在 ParseBench 排第一
- 相比上一代,速度与转录质量均有显著提升,处理吞吐最高翻倍
作者表示将用该模型进行常规微调测试。
所属事件:LightOn 开源 LightOnOCR-3:0.8B/1B/4B 三档全能文档模型(5 条相关)→
「模型」频道最新
- Google 医疗开源模型 MedGemma 论文登上 Nature Medicine — ymatias · 2026-10-09
- 研究员质疑:各家模型商条款是否允许用客户内容造合成数据 — RylanSchaeffer · 2026-10-09
- LFM 2.5 5.4B 被看好适合笔记本本地运行 — Aggravating-Push-207 · 2026-10-09
- 用户晒收 Claude 800 美元 API 补偿额度:领取后仅 10 天过期 — Daniel_Farinax · 2026-10-09
- X 订阅捆绑 Grok 与 Cursor,共享额度池成最大亮点 — nima_owji · 2026-10-09
- LightOnOCR-2 开源:0.8B 小模型反超更大对手 — IgorCarron · 2026-10-09