1590万参数专用OCR模型击败数百倍大的VLM

开源历史文献识别系统 Kraken 的专用 OCR 模型 PP-OCRv6 仅 15.9M 参数,却在 2,165 页历史文档评测集上取得阅读字符错误率(CER)第 4 的成绩,击败参数量大数百倍的视觉语言模型。该模型在保留长 s、连字等历史文本特征方面表现出色,显示专用小模型在细分任务上仍具竞争力。

2026-09-03 ~ 2026-09-03 · 2 条相关