公开危险能力评测可能反过来刺激模型优化

CFGeek · x · 2026-07-26

作者认为,AI 公司可能在刻意优化模型,让它们在公开的危险能力评测里拿更高分;如果属实,这会是个很严重的问题。

帖子主张要认真讨论是否应该停止对“增益研究”和危险能力评测的公开宣传,因为这类基准不该公开:一旦指标可量化,就会强化“数字越高越好”的优化冲动,反而让危险能力更容易被放大。

所属事件:马斯克及AI安全专家呼吁停止公开危险能力评测(6 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →