现有扩散LM解码调度太短视
furongh · x · 2026-07-06
指出大多数扩散语言模型的解码调度都是手工设计的(如置信度、熵、边界、从左到右等)。这些方法快但短视:它们只问"现在哪个 token 看起来容易",而推理需要更深的问题——"哪个揭示能让剩下的解答更容易?"
所属事件:SAS让扩散语言模型学会自感知调度(15 条相关)→
「研究」频道最新
- 一本 RLHF 新书完成,作者做了两年夜晚和周末 — HamelHusain · 2026-07-21
- Google DeepMind 分享 Project Genie 的创作者协作幕后 — alexanderchen · 2026-07-21
- Nat Lambert 反驳 RL 蒸馏直接用最强模型当老师 — natolambert · 2026-07-21
- 线程称 GPT-5.6 Sol 帮忙构造出 Jacobian 猜想反例工厂 — LucaAmb · 2026-07-21
- TimeLens2 以 4B 和 8B 模型拿下 7 项视频定位 SOTA — _akhaliq · 2026-07-21
- 真实数学进展常靠推翻旧直觉 — LucaAmb · 2026-07-21