幻灯片称生成式 AI 指标尤其容易被 Goodhart 定律扭曲
AlexKontorovich · x · 2026-07-25
- 这张幻灯片把 Goodhart 定律 放到生成式 AI 语境里解释:当一个指标变成目标,它就不再是好指标。
- 幻灯片认为,生成式 AI 天生更“非落地”,再叠加 AI 公司强烈的商业激励,使得很多评价指标更容易被过度优化、被指标游戏化。
- 这条帖子的重点不是一句鸡汤,而是对 AI 工具评测、目标函数和商业激励之间关系的提醒。
「漫话AGI」频道最新
- Alex Kontorovich 说 AI 工具仍太不透明 — sull · 2026-07-25
- 会议幻灯片警告:AI 优化可能让数学目标分化 — AlexKontorovich · 2026-07-25
- 青铜时代崩溃类比:文明或将成为外部推理引擎 — dylan522p · 2026-07-25
- 陶哲轩 ICM 2026 假设:AI 可能很快做研究级数学 — AlexKontorovich · 2026-07-25
- 研究者组队研究前沿 AI 的经济影响 — RishiBommasani · 2026-07-25
- ICM 讲稿称,多数 AI 能力主张缺乏受控证据 — AlexKontorovich · 2026-07-25