Hugging Face 深度解读:预训练与 RL 的联合缩放定律

Hugging Face · youtube · 2026-08-04

Hugging Face 研究团队在其 Journal Club 活动中,深入探讨了论文《Understanding Reasoning from Pretraining to Post-Training》。

该研究提出了一种针对预训练和强化学习的联合缩放定律。视频讨论重点分析了这种联合缩放规律如何跨越不同的训练阶段发挥作用,为理解大模型的推理能力涌现提供了新的视角。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →