动态权重嫁接:定位微调事实在 Transformer 中的两条检索通路
ChenhaoTan · x · 2026-10-06
arXiv 论文《Dynamic Weight Grafting》提出一种可解释性分析技术:将微调模型的部分权重子集「嫁接」回预训练模型,以定位微调新学事实(如新电影、新教皇)的存储位置。研究发现模型通过两条独立通路检索微调的关系信息:一是在处理实体 token 时(如「Zendaya」)用关系信息「丰富」残差流;二是在生成目标事实前的最后 token 位置「回忆」该信息。不同情况下两条通路可能都必需、或任一单独 suffices,「回忆」通路可被定位到具体模型组件。推文还提到相关做法:在合成文档上对基座模型做 next-token 预测微调,把权重更新直接应用到后训练模型上即可生效。
「研究」频道最新
- hardmaru 用 Schmidhuber 趣味理论解析 Twitter 新 Logo — hardmaru · 2026-10-06
- ViDiHand:视频扩散模型逆袭,从第一视角视频重建 4D 双手动作 — ccloy · 2026-10-06
- 近1/3博士论文由AI代写,新研究复现此前发现 — skdh · 2026-10-06
- 研究者尝试把 AI Village 数据映射到 Ising/Hawkes 系统 — ctjlewis · 2026-10-06
- 新攻击 PLW:恶意厂商可借图像水印泄露你的聊天隐私 — chaumian · 2026-10-06
- APSP 次立方与 3SUM 次平方算法问世,细粒度复杂度格局生变 — thegautamkamath · 2026-10-06