AI 数小时重写 TrackMania 物理引擎,自训 PPO 上赛道跑赢作者纪录
burny_tech · x · 2026-09-07
开发者 adonissingh 让 GPT-6 Astra 通过 /goal 模式自主工作了几个小时:修复了物理引擎 bug、降低内存占用,并对数百万 tick 做压力测试。
背景是被引用的原推:Fable-5.1 用约一天时间把 TrackMania Nations Forever 的物理引擎用纯 C 重写,并用游戏素材在浏览器中渲染重现,输入信号来自一个仅训练约 20 分钟的 PPO 策略。
项目现已支持 7 个环境共 212 条赛道(从 65 条扩展),作者还在备用 3060 上用 10–30 分钟训练小型 PPO agent,在部分赛道上打破了作者自己的纪录。
「编程与Agent」频道最新
- 多智能体自己学会「对话避让」,用户直呼干得漂亮 — ccerrato147 · 2026-09-07
- Stripe 推出机器支付:让 AI Agent 自动为 API 调用付费 — jeff_weinstein · 2026-09-07
- GEPA 不止用于训练模型,研究者基于 TRL 与 OpenEnv 推出 Agent 训练项目 — lateinteraction · 2026-09-07
- 开发者提醒:别在本机跑 AI Agent,用云 VM 保护隐私 — blelbach · 2026-09-07
- Agent 模板平台 Eden 转型 MCP server:模板留在你自己的仓库 — evilrabbit_ · 2026-09-07
- Reddit 热帖批「一句话生成游戏」:高能力展示实为 token 浪费 — rsvallen · 2026-09-07