新论文发现从预训练到后训练的联合 scaling law

Pavel_Izmailov · x · 2026-07-21

新论文把预训练和后训练连成统一 scaling law

这篇名为 《Understanding Reasoning from Pretraining to Post-Training》 的论文,研究的是整个 LLM 训练流水线,而不是把预训练和 RL 分开看。

原帖给出的核心结论是:

配图则展示了三部分:

所属事件:新研究提出预训练与RL联合缩放律(17 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →