新书《Post-Training AI》前两章草稿发布
作者发布新书《Post-Training AI: A Practical Guide to Fine-Tuning and Reinforcement Learning》的前几章草稿。该书以实践为导向,用几百行代码帮助读者跑通 SFT(监督微调)与 GRPO,并提供一条简洁路径,系统讲解 SFT、GRPO、知识蒸馏以及环境训练中 Agent 学习等后训练核心技术,是面向开发者的微调与强化学习实用指南。
2026-08-25 ~ 2026-08-26 · 3 条相关
- 《Post-Training AI》前两章草稿上线:几百行代码跑通 SFT 与 GRPO — ben_burtenshaw · 2026-08-25
- 新书《Post-Training AI》:微调与强化学习指南 — SergioPaniego · 2026-08-25
- 新书发布:SFT、GRPO 与蒸馏的后训练实践指南 — Hesamation · 2026-08-26