PUMBA 论文:让掩码扩散语言模型训练感知推理采样轨迹

kastnerkyle · x · 2026-10-07

新论文 PUMBA 研究掩码扩散语言模型(MDM)的一个核心错配:这类模型的训练方式与推理采样方式不一致。作者提出让训练更感知推理时实际遵循的采样轨迹,从而提升文本生成效率,论文链接附于推文线程中。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →