用Grok做游戏并训练PPO智能体,已开源

tetsuoai · x · 2026-09-02

作者使用 Grok 构建了浏览器游戏 Roofline,并在其无头端口上训练了 PPO (Proximal Policy Optimization) 智能体。该智能体作为 Tetsuo MLBot 实时在线游玩,最高分达 39,359。项目代码和权重已开源,支持本地训练或直接运行作者的模型。Python 仿真模拟了 120Hz 的实时物理效果,并优化了网络注入以减少延迟。目前游戏已增加实时排行榜并优化了移动端体验。

所属事件:开发者用 Grok 做游戏并训练 PPO 智能体(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →