Block Diffusion 让扩散语言模型也能高效复用 KV-cache

alec_helbling · x · 2026-09-11

扩散语言模型可并行生成多个 token,但迭代式解掩码会反复更新 token 状态,限制了 KV-cache 的复用。Block Diffusion 通过「从左到右逐块解码、块内并行生成」的方式恢复高效缓存,兼得扩散模型的并行性与自回归模型的缓存效率。

所属事件:Block Diffusion:扩散语言模型高效复用 KV 缓存(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →