腾讯开源 WeVisDoc 文档解析模型登顶 OmniDocBench
腾讯微信视觉团队开源端到端文档解析模型 WeVisDoc,提供 2B 与 4B 两个版本,输入整页文档图片即可一次输出完整 Markdown,正文、公式与表格统一转换。该模型采用两阶段数据中心框架,通过异构数据与保结构退化合成扩大覆盖面,在 OmniDocBench 上以 95.38 的总分登顶。后续评测细节显示,4B 版在端到端模型中整体领先,优势主要来自公式与表格解析,纯文字文档的识别成绩需单独查看。
2026-09-18 ~ 2026-09-19 · 3 条相关
- 腾讯 WeVisDoc 两阶段框架登顶 OmniDocBench,总分 95.38 — tencent · 2026-09-18
- 腾讯开源微信端到端文档解析模型 WeVisDoc,整页图直出 Markdown — xiaohu · 2026-09-19
- WeVisDoc-4B 端到端领先,但优势集中在公式与表格解析 — xiaohu · 2026-09-19