DiffusionGemma 可解释性研究:发现扩散模型非时序推理等新现象
burny_tech · x · 2026-08-28
一篇针对 DiffusionGemma 的可解释性案例研究论文指出,作者通过一系列 interpretability 案例分析,初步发现了多种扩散模型特有的新现象:
- 非时序推理(non-chronological reasoning)
- token 与序列涂抹(smearing)
- 中间上下文推理(intermediate-context reasoning)
这些现象为此前自回归模型研究中未见的扩散特有行为,为理解扩散语言模型的内部机制提供了新线索。
所属事件:扩散语言模型可解释性研究揭示非时序推理等新现象(2 条相关)→
「研究」频道最新
- 实测 7400 条轨迹:Terminus 2 最精简,CC/Codex 上下文膨胀三倍 — zainhas · 2026-08-28
- 谷歌 PPE 引擎综述:多领域预测精度显著超越专家管线 — ymatias · 2026-08-28
- Google Earth AI 推出行星预测引擎:自然语言生成地理洞察 — ymatias · 2026-08-28
- METR 发布 Hugging Face 攻击报告,被誉后人类文明首份人类学 — anderssandberg · 2026-08-28
- 视觉论文陷入“Instagram 时刻”:重结果轻科学,复现困难 — taiyasaki · 2026-08-28
- Judea Pearl:基因与 IQ 之争可循吸烟致癌路径科学求解 — yudapearl · 2026-08-28