让GPT-6训练12k参数小CNN玩VizDoom,达到35fps实时控制

paraschopra · x · 2026-09-28

Paras Chopra 展示了一个巧妙思路:大模型不直接实时操控游戏(太慢),而是让 GPT-6 Astra 写代码训练一个仅 1.2 万参数的小 CNN 来玩 VizDoom,观察失败、迭代改进,直到通关该关卡,最终实现 35 fps 的实时控制。核心是把 LLM 当「教练/训练器」而非「玩家」,用小模型承担低延迟推理。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →