LightOn 发布第三代 OCR 模型 LightOnOCR-3,公开数据构建细节
IgorCarron · x · 2026-10-09
LightOn 团队发布第三代 OCR 模型 LightOnOCR-3,由 CavaillesAdrien 等人合作完成。发布帖以线程形式介绍 grounding 数据的构建方法,以及如何利用训练过程中的中间检查点(intermediate checkpoints)来改进后续训练所用的标注数据——这是一种用早期模型辅助提升数据质量的迭代做法。对关注文档理解与 OCR 数据工程的人有参考价值。
所属事件:LightOn 开源 LightOnOCR-3:三尺寸模型问鼎 OCR 榜单(22 条相关)→
「多模态」频道最新
- Midjourney 开测 MCP,招募创意社区抢先体验 — midjourney · 2026-10-10
- 两块 GPU 烧 48 小时跑本地视频模型,全 AI 流程做出音乐 MV — tetsuoai · 2026-10-10
- 用「相信你自己」提示法调教 LLM 写 3D SDF 模型实测 — keenanisalive · 2026-10-10
- 不用 mesh 和 3DGS,他用 LLM 写 27KB GLSL 代码生成 3D 龙 — keenanisalive · 2026-10-10
- Adobe 推出 OmniSeek:让 Omni 模型主动检索音视频证据做多轮推理 — mohitban47 · 2026-10-10
- 尼康因参赛作品使用生成式 AI,撤销显微视频大赛冠军 — nordicinst · 2026-10-10