AI 读书会九月共读 RLHF,作者将在结束后参与讨论

sophiamyang · x · 2026-09-02

AI Book Club 九月份的阅读书目是 @natolambert 所著的《Reinforcement Learning from Human Feedback》。该书适合从事模型后训练工作的开发者,覆盖指令微调、奖励模型、PPO 与 DPO 对比、偏好数据以及鲜少公开的失败模式。读书会每月读一本 AI 书籍,在 Discord 讨论,并在结束后邀请作者进行交流。

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →