MonkeyOCRv2 文档 AI 视觉文本模型发布
研究人员提出了一款面向文档 AI 的视觉-文本基础模型 MonkeyOCRv2。该模型的一大核心亮点是采用了文档原生视觉编码器,同时作者还构建了包含高达 1.13 亿张图像的 MonkeyDoc v2 数据集,以推动文档智能处理技术的发展。
2026-07-14 ~ 2026-07-15 · 2 条相关
- MonkeyOCRv2:文档AI基础模型 — _reachsumit · 2026-07-14
- MonkeyOCRv2:文档AI视觉模型 — VLRLab-OCR · 2026-07-15