Yoav Goldberg:能暴力刷分的基准都会被解决,能力未必可迁移
herbiebradley · x · 2026-09-04
AI 研究者 Yoav Goldberg 提出一个衡量 AI 进展的悲观框架:任何能可靠评分、且愿意投入巨额资金暴力训练的任务/环境,最终都会被解决;而每个有挑战性且流行的基准都会达到这个标准——但这不意味着能力会真正迁移。他由此提出核心问题:我们到底该如何衡量真实进展?评论区有人追问是否要靠 human-in-the-loop / centaur 评测来补充。这条观点指向「刷分≠能力」的老问题的更尖锐版本。
所属事件:Yoav Goldberg:可打分任务终将被暴力训练攻破(2 条相关)→
「漫话AGI」频道最新
- Paradigm 3 周报:低质 RL 环境或解释 reward hacking 与拟人化之争 — gleech · 2026-09-04
- 新模型对齐评测零失败率,反被安全研究员视为坏信号 — connoraxiotes · 2026-09-04
- 悲观解读:OpenAI 训不动大模型,转向 RL 与推理提智 — teortaxesTex · 2026-09-04
- 安全研究者引用专业标准质疑 Sam Altman 的安全承诺 — davidmanheim · 2026-09-04
- 全 AI 媒体抢先记者拿到 OpenAI 独家,自动化编辑部再引争论 — emmanuelvivier · 2026-09-04
- AI 解开数学猜想,数学界却在抱怨解法不合心意 — avt_im · 2026-09-04