可解释性实验让两种场景记忆碰撞

graceisford · x · 2026-07-13

这条转述了一组关于 world generation model 的机械可解释性实验:作者在生成过程里尝试 activation patching,把一段由莫奈《罂粟花田》生成时的中间层激活,注入到同层的纽约 Manhattanhenge 生成过程中。

结果呈现出一种“两个记忆在争夺同一片区域”的效果,作者借此强调:机械可解释性可以和艺术生成结合,用可控的中间层干预观察模型内部表征如何影响输出。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →