设想:让 RL 智能体游玩数百万次,训练可下载权重的生成式游戏

theteknosaur · x · 2026-09-15

作者设想:若自己是 Rockstar CEO,会在《GTA 6》发售后的十年里让强化学习智能体游玩新游戏数百万次,用其游戏过程作训练数据,训练出一个学习运行游戏世界的生成式模型,然后把模型权重卖给玩家——玩家下载权重游玩,游玩即推理。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →