HPD-Parsing reaches 4,752 tokens/s by replacing page-wide autoregression

PaddlePaddle · hf · 2026-07-22

HPD-Parsing replaces page-wide autoregression with hierarchical parallel decoding

This paper tackles the sequential bottleneck in unified VLM-based document parsers.

Related event: HPD-Parsing Achieves High-Throughput Document Parsing via Hierarchical Parallel Decoding(2 posts)→

Original post →

More from Research

Research channel →