kalomaze:LoRA 里权重衰减更像正则回基座而非惩罚权重

kalomaze · x · 2026-10-04

kalomaze 指出一个有趣的细节:在 LoRA 微调场景下,weight decay 的实际语义效果更像「把权重往基座模型的原始权重方向正则化」,而非传统意义上的「惩罚权重绝对值大小」。原因在于 LoRA 只训练低秩增量,正则项在数学上等效于把增量往基座权重靠拢,而不是把权重压向零。这一观察对理解微调中的正则化行为有参考价值。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →