Olmo 3 讲座拆解 DPO、数据难题与研究落地

natolambert · x · 2026-07-29

Olmo 3 后训练与 DPO 讲座:研究想法如何落地到近前沿模型

Nathan Lambert 介绍了一期和 Scott Geng 的播客/讲座,主题是 Olmo 3 的后训练流程与 DPO 实践。内容不只是算法本身,更强调研究落地时的各种脏活累活。

所属事件:Olmo 3 讲座探讨后训练流程与 DPO 技术落地(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →