AI 读书会 9 月共读 Nathan Lambert 新书《RLHF》,作者亲临线上对谈

natolambert · x · 2026-09-13

The AI Book Club 宣布本月共读 Nathan Lambert 的新书《Reinforcement Learning from Human Feedback》,9 月 24 日上午 9 点(CT)举办线上作者对谈,可 RSVP 参加。该读书会每月精读一本 AI 书,在 Discord 讨论后再与作者连线交流。

该书覆盖预训练之后的关键环节:指令微调、奖励模型、PPO 与 DPO 对比、偏好数据及各类失败模式,适合从事后训练工作的从业者。

所属事件:AI 读书会 9 月共读 Lambert 新书《RLHF》并邀作者对谈(2 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →