AI 评测的根本误区:把评估当对抗问题注定失败

jankulveit · x · 2026-10-07

AI 评测从业者 Jan Kulveit 提出,评测圈的核心误区是把 benchmark 视为对抗性(adversarial)问题,这条路注定失败。他认为唯一合理框架是换个角度自问:「如果我是 AI,想可信地展示自己的某种能力、目标或美德(或缺席),什么样的设置或流程能帮我做到?」——评测本质上是一个协作性(collaborative)问题,而非攻防博弈。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →