AI 读书会 9 月共读 Nathan Lambert 新书《RLHF》,作者亲临线上对谈
natolambert · x · 2026-09-13
The AI Book Club 宣布本月共读 Nathan Lambert 的新书《Reinforcement Learning from Human Feedback》,9 月 24 日上午 9 点(CT)举办线上作者对谈,可 RSVP 参加。该读书会每月精读一本 AI 书,在 Discord 讨论后再与作者连线交流。
该书覆盖预训练之后的关键环节:指令微调、奖励模型、PPO 与 DPO 对比、偏好数据及各类失败模式,适合从事后训练工作的从业者。
所属事件:AI 读书会 9 月共读 Lambert 新书《RLHF》并邀作者对谈(2 条相关)→
「公司和人」频道最新
- 曝 Dario 欲放缓研究省算力开支为 IPO 铺路 — pdamodaran · 2026-09-13
- Bindu Reddy 调侃 Google:谈「给前沿降速」实则连开源都追不上 — bindureddy · 2026-09-13
- 斯坦福免费公开 2100+ 门课程,完整 AI 研究生课程在线可学 — Aiden_Tech_Ai · 2026-09-13
- 投资人 Jeff Weinstein 表态想投 agent 优先硬件与新操作系统 — jeff_weinstein · 2026-09-13
- OpenAI 办 GPT-6 Astra 黑客松,参赛者:GPT-Live-1 令人震撼 — gabrielchua · 2026-09-13
- 《纽约时报》整版 AI 监管呼声,咨询顾问称企业正加速撤离前沿模型 — OvertaxedOne · 2026-09-13