掩码扩散模型并行生成存在联合不连贯缺陷

开发者 alechelbling 在技术推文中指出掩码扩散模型的核心局限:同一步并行采样的多个 token 在给定上下文时相互条件独立,导致联合结果不连贯。他以下棋举例,独立采样可能产生「Alice 认输后又获胜」这类各自合理、合起来矛盾的输出。由此推论,数独等结构化推理任务每次可能只能生成一两个相互依赖的 token,维持连贯需更多采样轮次,限制了扩散 LLM 的并行推理加速空间。

2026-09-05 ~ 2026-09-05 · 3 条相关