研究者让前沿 AI 玩宝可梦,测量分布外泛化能力

scaling01 · x · 2026-09-24

研究者 gleech 等人想弄清当前前沿模型「分布外」泛化能力有多强——即解决从未见过的问题的能力,以判断 AI 进展速度。他们选择让多个 AI 玩宝可梦游戏作为测试场景,观察模型在陌生规则环境中的推理与适应表现。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →