研究发现 Transformer 内部存在忠实的世界模型
arXiv 论文《World Modeling in Transformers》回应了「Transformer 没有世界模型」的质疑。研究者在曼哈顿随机游走数据上训练了 taxiGPT,通过可解释性分析发现模型内部存在一张忠实的「世界地图」:Transformer 并非没有学到世界模型,而是不同特征相互叠加干扰,导致世界模型难以直接显现。这一发现为理解大模型的内部表征提供了新证据。
2026-09-23 ~ 2026-09-23 · 2 条相关
- 可解释性论文发现 taxiGPT 内部存在忠实的世界地图模型 — __nmca__ · 2026-09-23
- 论文:Transformer 并非没有世界模型,而是特征叠加互相干扰 — burny_tech · 2026-09-23