预训练决定低秩几何,微调无法修复基础错误

yunta_tsai · x · 2026-08-21

核心观点是预训练负责确立正确的低秩几何结构,而强化学习(RL)负责微调形状。如果低秩几何基础打得好,需要的微调就越少。反之,如果观察数据存在巨大缺口,微调无法修复低秩层面的错误,因为优化器根本不知道正确的形状应该是什么。

所属事件:观点:预训练决定低秩几何,RL微调仅能修形状(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →