MonkeyOCRv2 文档 AI 视觉文本模型发布

研究人员提出了一款面向文档 AI 的视觉-文本基础模型 MonkeyOCRv2。该模型的一大核心亮点是采用了文档原生视觉编码器,同时作者还构建了包含高达 1.13 亿张图像的 MonkeyDoc v2 数据集,以推动文档智能处理技术的发展。

2026-07-14 ~ 2026-07-15 · 2 条相关