智谱 CogVLM2 模型表现亮眼:OCR 任务达 SOTA 级别

teortaxesTex · x · 2026-08-23

作者对智谱的 CogVLM 系列表示赞赏,指出其基于 Llama 3 的 V2 版本在文本恢复任务上表现出色,达到了 SOTA (State of the Art) 级别。该模型拥有 1344x1344 分辨率和巨大的编码器,并已发布相关数据集。

所属事件:智谱 CogVLM2 视觉模型 OCR 表现达 SOTA(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →