Goodfire 发布参数分解新方法,把语言模型拆成忠实子组件

Sauers_ · x · 2026-10-02

Goodfire 联合 MATS 等机构发表研究《Interpreting Language Model Parameters》,提出 adVersarial Parameter Decomposition(VPD)方法,试图回答机制可解释性中长期悬而未决的问题:神经网络的数百万到数万亿参数究竟学到了什么结构、如何实现智能计算。

所属事件:Goodfire发布VPD参数分解法,拆解语言模型内部结构(6 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →