算力越高,最优分配越从预训练转向 RL

Pavel_Izmailov · x · 2026-07-21

论文指出,在给定总算力下,预训练和 RL 的最优分配会随着预算变化而改变。

所属事件:新研究提出预训练与RL联合缩放律(17 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →