LightOnOCR-3 训练秘辛:用 OCR 参考文本引导逻辑分块

IgorCarron · x · 2026-10-09

LightOn 团队分享 LightOnOCR-3 训练数据处理细节:目标是产出逻辑块而非 mere 布局框。做法是以 LightOnOCR 2 的输出作为一致性参考文本,用其段落边界来指导检测到的文本行如何分组为块,从而为下游 chunking 生成连贯的逻辑块。这一细节揭示了多模态文档解析模型在训练数据构建上的工程考量。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →