密歇根大学:换更可扩散的嵌入空间,连续扩散语言模型超越 GPT-2-M

umich · hf · 2026-10-02

密歇根大学研究探索连续扩散语言模型(DLM)该用什么嵌入作潜在空间,即哪种嵌入最「可扩散」。

关键发现:

最终中型 DLM 在 OpenWebText 上取得生成 PPL 17.8(真实文本 PPL 15.4),优于 GPT-2-M。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →