WeVisDoc-4B 端到端领先,但优势集中在公式与表格解析
xiaohu · x · 2026-09-19
腾讯微信视觉团队的 WeVisDoc 开源后,作者补充评测细节:4B 版在端到端模型中整体领先,优势主要来自公式和表格解析;处理以文字为主的文档时,文字识别成绩需单独查看。技术报告显示其在 OmniDocBench v1.6 与 PureDocBench 三个赛道(干净/算法退化/真实采集)的端到端类别居首,但在全部模型横向对比中并非全面第一:PureDocBench 综合分第一主要靠公式与表格,纯文字识别不是最强,OmniDocBench 输给 MinerU 等两个流水线系统,真实拍摄页输给两个通用大模型。模型基于 Qwen3-VL 2B/4B 底座,训练采用先广覆盖、再按残差区分缺数据还是练得少的两段式方法。
所属事件:腾讯开源 WeVisDoc 文档解析模型登顶 OmniDocBench(3 条相关)→
「模型」频道最新
- XGEN 发布生成式世界模拟系统:JING 模型登顶 WBench Full 榜 — hey_abusiddik · 2026-09-20
- 评测者称纯代码启发式策略可在 Craftax 上胜过大模型 — JoshPurtell · 2026-09-20
- OpenAI Codex 全员重置已生效,官方预告周二有大发布 — kimmonismus · 2026-09-20
- Jev 做 PR 审查比 GPT-5.6 Luna 快 1.93 倍,单次仅 $0.0014 — aniketmaurya · 2026-09-20
- 果蝇连接组国际象棋模型击败 Jev,Labonne 再战一个 — maximelabonne · 2026-09-20
- Bonsai 2 27B 安全护栏砍掉近 20 分,SWE-bench 与 Terminal-bench 成绩大缩水 — julianharris · 2026-09-20