新书《Post-Training AI》:微调与强化学习指南

SergioPaniego · x · 2026-08-25

发布了新书《Post-Training AI: A Practical Guide to Fine-Tuning and Reinforcement Learning》的前几章。书中通过简明的路径讲解后训练,帮助建立关于SFT、GRPO、蒸馏和环境的直觉,并提供了数百行代码的最小实现。

所属事件:新书《Post-Training AI》前两章草稿发布(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →