HPD-Parsing 在 OmniDocBench 上达 94.91%,吞吐 4752 TPS

pmttyji · reddit · 2026-07-23

HPD-Parsing 提出了一种用于文档解析的分层并行解码方案。

它用主布局分支负责全局结构协调,再把内容生成动态分派给多个局部并行分支;同时结合 Progressive Multi-Token Prediction 和共享前缀 KV cache 复用,进一步缩短解码路径。帖子称,这个 1B 模型在 OmniDocBench v1.6 上拿到 94.91%,峰值吞吐达到 4,752 TPS,比此前最快的解析器快 2.62×,也比自身自回归基线快 3.06×。

所属事件:HPD-Parsing 层级并行解码实现极速文档解析(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →