Hugging Face 深度解读:预训练与 RL 的联合缩放定律
Hugging Face · youtube · 2026-08-04
Hugging Face 研究团队在其 Journal Club 活动中,深入探讨了论文《Understanding Reasoning from Pretraining to Post-Training》。
该研究提出了一种针对预训练和强化学习的联合缩放定律。视频讨论重点分析了这种联合缩放规律如何跨越不同的训练阶段发挥作用,为理解大模型的推理能力涌现提供了新的视角。
「研究」频道最新
- Gravner-Griffeath 六边形元胞自动机可视化演示 — matthen2 · 2026-08-05
- NeurIPS 2026 征稿:聚焦具身智能与空间推理 — du_yilun · 2026-08-05
- HazyResearch 开源 MoK:专为 NVL72 打造的 MoE 融合算子 — HazyResearch · 2026-08-05
- 《经济展望杂志》发 AI 专刊,探讨 AI 经济影响 — TaniaBabina · 2026-08-05
- AI 工具 Silico:用动作模型检测帕金森病步态 — ninamiolane · 2026-08-05
- 机器人需要定制小模型:微调Qwen比调API更准更省 — ChongZzZhang · 2026-08-05