离散扩散并行采样加速 LLM 推理,无需草稿模型且无损

IFM · hf · 2026-09-08

IFM 在 Hugging Face 发布「Diffusion-augmented autoregressive language models」相关研究,提出用离散扩散权重蒸馏 + 专用采样器实现并行 token 采样,从而加速自回归 LLM 推理。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →