HPD-Parsing 以层级并行解码把解析提速到 4,752 tokens/s
PaddlePaddle · hf · 2026-07-22
HPD-Parsing 用层级并行解码替代整页自回归
这篇工作针对统一式 VLM 文档解析器的顺序瓶颈提出新方案。
- 现有解析器虽然会把整页一起处理,但输出仍然走单一路径的 token-by-token 自回归,文档越长越慢。
- 作者认为文档解析其实有两层需求:一层是 全局布局分析,另一层是 块级内容并行解析。
- 为此他们提出 HPD-Parsing:用一个 主布局分支 组织整页结构,再把块级内容动态分配给多个并发解码分支。
- 另外再加上 progressive multi-token prediction(P-MTP),进一步减少每个分支需要的解码步数。
- 在公开基准上,系统达到 4,752 tokens/s,比最快的已有文档解析模型快 2.62 倍,比原始自回归基线快 3.06 倍。
- 同时解析精度仍保持有竞争力,说明层级并行解码可以成为整页自回归之外的一条可行路线。
所属事件:HPD-Parsing 层级并行解码实现极速文档解析(2 条相关)→
「研究」频道最新
- 数学家 Daniel Litt 上线问题库,15 题仅 1 题被解,用来追踪 AI 解题进度 — littmath · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- 本周热议的数学猜想到底关我什么事?一张普通人视角清单 — koltregaskes · 2026-09-11
- 用果蝇大脑连接组造了个 LLM,作者放出在线 demo — ngxson · 2026-09-11
- 社会学家 Harry Collins:LLM 无法发明新语言,做不了前沿科学 — whoamisri · 2026-09-11