EMNLP 论文揭示语言扩散模型本质是联想记忆
IBM 与 RPI 合作、入选 EMNLP 2026 主会的论文《Language Diffusion Models are Associative Memories》揭示了语言扩散模型(LDM)的本质是联想记忆,其泛化能力存在明确的相变点。研究发现扩散模型除记住训练数据外,在处理未见样本时也会形成新颖吸引子,即记忆与创造性吸引子可以共存,这为理解此类模型的泛化与创造机制提供了新视角。
2026-09-08 ~ 2026-09-08 · 2 条相关
- EMNLP 论文揭示语言扩散模型本质是联想记忆,泛化有明确相变点 — LucaAmb · 2026-09-08
- EMNLP 论文:扩散模型对未见样本也会形成记忆吸引子 — LucaAmb · 2026-09-08