仅 1590 万参数的 Kraken OCR 模型,历史文本识别超越大数百倍 VLM

vanstriendaniel · x · 2026-09-03

开源历史文献识别系统 Kraken 的专用 OCR 模型 PP-OCRv6 只有 15.9M 参数,却在 2165 页历史文献评测集上排名阅读字符错误率(CER)第 4,并在保留长 s、连字和大小写信息时排名第一,胜过许多体积大数百倍的通用视觉语言模型。

对小参数专用模型在低资源语言与长尾数字化场景的潜力是很好的印证。

所属事件:1590万参数专用OCR模型击败数百倍大的VLM(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →