DiffusionGemma 透明度研究:揭示非时序推理与 token 涂抹现象
burny_tech · x · 2026-08-28
该论文探讨了扩散大语言模型(如 DiffusionGemma)的推理透明度问题。研究将透明度分解为变量透明度和算法透明度。虽然 DiffusionGemma 初看似乎在连续潜在空间中进行了大量不透明计算,但在引入可解释的 token 瓶颈后,其不透明串行深度仅比自回归 Gemma 4 高出 1.1 倍。论文揭示了扩散模型特有的现象,包括非时序推理、token 与序列涂抹以及中间上下文推理。然而,算法透明度对扩散模型而言仍更具挑战性,因为画布上的所有 token 在每次去噪步骤中都可能发生变化。
所属事件:扩散语言模型可解释性研究揭示非时序推理等新现象(2 条相关)→
「研究」频道最新
- 谷歌推PPE引擎,AI全自动搞定地理空间预测 — aigclink · 2026-08-28
- 如何理解 AI 生态的事故复盘?需新界面翻译高维空间 — nptacek · 2026-08-28
- Self-OPD:无教师流的流匹配模型策略蒸馏 — Shiyi Zhang · 2026-08-28
- 进化策略训练 LLM 推理:Pass@K 覆盖面优于 GRPO — Yunpeng Ba · 2026-08-28
- Google 发布 WikiSkill:将智能体经验编译为持久知识 — google · 2026-08-28
- 论文:从 ACE 视角看如何为 LLM 智能体生成优质数据 — Xingshan Zeng · 2026-08-28