14 岁作者用强化学习训练 AI 玩 PolyTrack 赛车,揭示极端闭环敏感性

michael201110 · reddit · 2026-10-06

一位 14 岁作者分享了其强化学习项目 PolyBot:训练 AI 在赛车游戏 PolyTrack 中驾驶。项目先后尝试 TQC、PPO 和 GRTQC 等方法。

关键发现

工程实现

项目附视频演示与开源代码(GitHub: michael201110/poly-bot),作者征求连续控制 RL 方面的反馈,尤其是闭环敏感性问题;下一步计划把数百次历史训练以游戏内幽灵车形式可视化。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →