Goodfire 提出 VPD 方法拆解大模型参数结构

Goodfire 联合 MATS 等机构的研究者发布论文《Interpreting Language Model Parameters》,提出名为 VPD 的参数分解方法,可将大模型参数拆解为忠实的子组件,从而解释语言模型参数的内部结构。开发者 Sauers 也发布了相关的 "virtual structures" 内容并链接了这项研究,引发社区关注。

2026-10-02 ~ 2026-10-02 · 2 条相关