SAS把解码顺序变成可训练推理策略

furongh · x · 2026-07-06

SAS(自感知调度器)把解码顺序变成一种可训练的推理策略。它不训练整个语言模型,而是训练一个轻量级调度器,扩散 LM 保持冻结。每一步调度器选择下一个揭开的掩码位置,调度过程本身就成为"思考过程"。

所属事件:SAS让扩散语言模型学会自感知调度(15 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →