Natolambert finishes a RLHF book built from years of fine-tuning and post-training work

Jeande_d · x · 2026-07-21

Natolambert says their book, Reinforcement Learning from Human Feedback, is finished.

Related event: Nathan Lambert Completes RLHF Book After Two Years with Courses and Code(8 posts)→

Original post →

More from Research

Research channel →