强化学习开源资源两则:从零实现算法与经典清单

社区分享了两份强化学习开源资源:ChristianOrr 的 GitHub 仓库 reinforcement-learning-algorithms 提供从零手写的算法实现,覆盖从 Q-learning 等表格型方法到 DQN、PPO 等深度强化学习,适合配合 Notebook 逐步学习;另一份是 aikorea/awesome-rl 精选清单,约 9.9k star,涵盖理论、课程、书籍、综述等资源,虽已停止维护,仍被视为强化学习资源大全。

2026-09-05 ~ 2026-09-05 · 2 条相关