HC-DLM:分层连续扩散语言模型,离散 token 与连续潜轨迹耦合去噪

UIUC-CS · hf · 2026-10-02

论文提出分层连续扩散语言模型(HC-DLM),针对两类扩散语言模型的结构瓶颈:

HC-DLM 在单一有原则的去噪过程中耦合离散 token 生成与连续潜在轨迹,训练目标由 token 似然的变分界导出;潜变量是唯一持久的生成状态,每步从它读出 token 并反馈为下一轮潜变量更新的支架。在结构化推理(Sudoku)、数学规划(Countdown)与语言建模(LM1B)上,同尺寸下谜题准确率与生成困惑度均优于离散与连续扩散基线。项目页:hc-dlm.github.io。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →