HPD-Parsing 以层级并行解码把解析提速到 4,752 tokens/s
PaddlePaddle · hf · 2026-07-22
HPD-Parsing 用层级并行解码替代整页自回归
这篇工作针对统一式 VLM 文档解析器的顺序瓶颈提出新方案。
- 现有解析器虽然会把整页一起处理,但输出仍然走单一路径的 token-by-token 自回归,文档越长越慢。
- 作者认为文档解析其实有两层需求:一层是 全局布局分析,另一层是 块级内容并行解析。
- 为此他们提出 HPD-Parsing:用一个 主布局分支 组织整页结构,再把块级内容动态分配给多个并发解码分支。
- 另外再加上 progressive multi-token prediction(P-MTP),进一步减少每个分支需要的解码步数。
- 在公开基准上,系统达到 4,752 tokens/s,比最快的已有文档解析模型快 2.62 倍,比原始自回归基线快 3.06 倍。
- 同时解析精度仍保持有竞争力,说明层级并行解码可以成为整页自回归之外的一条可行路线。
所属事件:HPD-Parsing 层级并行解码实现极速文档解析(2 条相关)→
「研究」频道最新
- 3D ResNet 论文八年突破 3000 引用,Kinetics 数据集成里程碑 — HirokatuKataoka · 2026-09-11
- 把数据调度变成优化的一部分:样本选择与排序影响 LLM 训练 — Puzzleheaded_Box2842 · 2026-09-11
- Jeff Heaton《神经网络数学导论》开放免费完整下载 — blaizedsouza · 2026-09-11
- 数学家 Daniel Litt 上线问题库,15 题仅 1 题被解,用来追踪 AI 解题进度 — littmath · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11