HPD-Parsing 在 OmniDocBench 上达 94.91%,吞吐 4752 TPS
pmttyji · reddit · 2026-07-23
HPD-Parsing 提出了一种用于文档解析的分层并行解码方案。
它用主布局分支负责全局结构协调,再把内容生成动态分派给多个局部并行分支;同时结合 Progressive Multi-Token Prediction 和共享前缀 KV cache 复用,进一步缩短解码路径。帖子称,这个 1B 模型在 OmniDocBench v1.6 上拿到 94.91%,峰值吞吐达到 4,752 TPS,比此前最快的解析器快 2.62×,也比自身自回归基线快 3.06×。
所属事件:HPD-Parsing 层级并行解码实现极速文档解析(2 条相关)→
「研究」频道最新
- DeepSeek-V4 在昇腾 SuperPOD 上后训练达 34.22% MFU — _akhaliq · 2026-07-23
- Hugging Face 推出 The Stack v3,含 5T tokens 代码数据 — lvwerra · 2026-07-23
- 论文研究开权重语言模型中的材料科学机制表征 — _akhaliq · 2026-07-23
- 机械可解释性工作坊摘要投稿截至 8 月 1 日 — nsaphra · 2026-07-23
- 一个 Reddit MCP 工作流把深度学习方案拆成规格、代码和验证 — hypergraphr · 2026-07-23
- 三种 LLM 评测指标能抓住生产故障,另外两种会漏掉 — Future_AGI · 2026-07-23