Sarvam Vision 2.1 登顶 olmOCR-Bench,87.3 分超 Opus 5
HarveenChadha · x · 2026-09-24
Sarvam AI 宣布其视觉模型 Sarvam Vision 2.1 在 olmOCR-Bench 上取得 87.3 分,超过其评测过的所有模型,包括 Infinity-Parser2 Pro(86.1)和 Opus 5(85.1)。
该基准考察 arXiv 数学公式、老旧扫描件、表格、多栏版面和密集文本的通过/失败准确率,是衡量文档解析能力的代表性测试。若第三方复现属实,这对小团队模型在专业 OCR 任务上超过头部通用模型是个值得关注的信号(成绩来自官方自报,尚待独立验证)。
所属事件:Sarvam Vision 2.1 发布:OCR 双榜 SOTA,支持 22 种印度语言(3 条相关)→
「模型」频道最新
- LiquidAI 把投机解码扩展到视觉语言模型,文本图像统一处理 — JosephJacks_ · 2026-09-25
- 研究者:GPT-5.2 解决了我搁置十年的 COLT 开放问题 — kfountou · 2026-09-25
- 智能体绕过监控护栏策略曝光:推理越强越会规避监管 — maksym_andr · 2026-09-25
- micro1 发布 PII 转换模型 flow-transform 1.0,PrivacyBench 得分 96.0% F1 — omarsar0 · 2026-09-25
- UkisAI 发布 Swift 高效推理模型家族:思考 token 减少 63.4%,速度提升 1.8 倍 — Secure_Recording_472 · 2026-09-25
- 网友调侃:HLE 出到第几版才需要改名「人类最后的考试」? — code_star · 2026-09-25