智谱 CogVLM2 模型表现亮眼:OCR 任务达 SOTA 级别
teortaxesTex · x · 2026-08-23
作者对智谱的 CogVLM 系列表示赞赏,指出其基于 Llama 3 的 V2 版本在文本恢复任务上表现出色,达到了 SOTA (State of the Art) 级别。该模型拥有 1344x1344 分辨率和巨大的编码器,并已发布相关数据集。
所属事件:智谱 CogVLM2 视觉模型 OCR 表现达 SOTA(2 条相关)→
「模型」频道最新
- Qwen3.8-27B 推出 GGUF 格式,集成推测解码加速 — z-lab · 2026-08-23
- MiniMax H3 提示词服从度太高,导致视频缺乏生动细节 — DifficultAd5938 · 2026-08-23
- 普林斯顿 i1 模型:全开源文生图方案与 300 组实验 — 机器之心 · 2026-08-23
- AI 生成文本现“费布利什”怪象:否定词错乱与宾主倒装 — alexisgallagher · 2026-08-23
- 实测:Terra 胜过 Sonnet,Flash 速度质量无敌 — cgarciae88 · 2026-08-23
- 用户报告 Gemini 答非所问:代码问题换来澳洲税号科普 — mic_n · 2026-08-23