机制可解释性研究:双重下降是记忆与泛化的相变

gordic_aleksa · x · 2026-09-15

Aleksa Gordić 挖出 Anthropic 机制可解释性博客中一个较冷门的发现:双重下降(double descent)可被理解为模型从「记忆单个样本」到「学习可复用结构」的相变。

泛化似乎在每个底层特征以不同组合出现多次后才会产生(最简单实验中约每特征出现 10 次);重复的数据点会与可复用特征争夺模型容量。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →