Yoav Goldberg:能用分数衡量的任务都会被暴力训练攻破

yoavgo · x · 2026-09-04

知名 NLP 研究者 Yoav Goldberg 提出一个关于衡量 AI 进展的冷峻判断:任何能被可靠打分的任务/环境,只要投入足够多的钱(他形容为「惊人的数量」)进行暴力式训练,最终都会被解决;而每一个有挑战性且流行的 benchmark 都会达到这个门槛,因此都会被攻克。但关键问题是:被攻克的这些能力并不一定会迁移到其他任务上。这意味着「benchmark 成绩」与「真实能力提升」正在脱钩,他最后抛出核心疑问:我们到底该如何衡量模型的真实进展?

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →