Block Diffusion Brings KV-Cache Reuse to Diffusion LMs

Block Diffusion, an ICLR 2025 Oral paper, interpolates between autoregressive and diffusion language models by decoding left-to-right block by block with parallel generation within blocks, enabling efficient KV-cache reuse for diffusion LMs.

2026-09-11 ~ 2026-09-11 · 2 related posts