知名游戏测不出真水平:AI 游戏评测陷入两难困境

banteg · x · 2026-09-06

开发者 FakePsyho 指出,用游戏测试 AI 模型目前处在一个尴尬位置:

这条吐槽点破了当前游戏类 AI 评测的信息污染问题:"模型见过的资料"可能比"模型的能力"更能决定成绩。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →