LoRA 第一步并非标准 SGD:隐式低秩预条件子拖慢微调

pbaylies · x · 2026-09-07

作者指出 LoRA 的训练动力学与直觉不符:它并不对权重执行标准 SGD。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →