LoRA 初始化一直被做错,SVD 初始化可加速 RL 训练收敛

burny_tech · x · 2026-09-17

Trajectory 团队发现社区普遍采用的 LoRA 权重初始化方式是次优的:改用权重矩阵的奇异值分解(SVD)来同时确定冻结权重与 LoRA 初始化,可以让 RL 训练收敛更快。该工作是 PiSSA 的扩展,团队在探索 agent RL 中可训练几何形状选择时得出此结论。

所属事件:SVD 初始化 LoRA 可加速 RL 训练收敛(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →