新书《Post-Training AI》前两章草稿发布

作者发布新书《Post-Training AI: A Practical Guide to Fine-Tuning and Reinforcement Learning》的前几章草稿。该书以实践为导向,用几百行代码帮助读者跑通 SFT(监督微调)与 GRPO,并提供一条简洁路径,系统讲解 SFT、GRPO、知识蒸馏以及环境训练中 Agent 学习等后训练核心技术,是面向开发者的微调与强化学习实用指南。

2026-08-25 ~ 2026-08-26 · 3 条相关