MonkeyOCRv2 创开源 SOTA,超越 Qwen3-VL-235B

jiqizhixin · x · 2026-08-07

华中科技大学与金山办公联合提出文档 AI 基础模型 MonkeyOCRv2。该模型基于 1.13 亿张、覆盖 17 种语言的文档图像进行训练,能从像素级理解文字及其笔画形态。

实验显示,其识别准确率从 58.7% 提升至 67.3%,在 MDPBench 上创下开源新纪录,并在文档解析与理解任务上超越了 Qwen3-VL-235B 等参数量远大于它的模型。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →