Pedro Domingos:我们需要防 Goodhart 的衡量指标

pmddomingos · x · 2026-09-03

知名计算机科学家、《终极算法》作者 Pedro Domingos 发推短评:「我们需要防 Goodhart 的衡量指标(Goodhart-proof measures)」。

这句话指向 AI 评测领域的核心痛点:当某个指标成为优化目标(如 benchmark 刷榜),它就会因被过度优化而失去衡量意义——即 Goodhart 定律「当指标变成目标,就不再是好指标」。在模型厂商以 benchmark 成绩作为主要发布卖点的当下,这是对评测体系可信度的直接质疑。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →