有人提议造"反向对齐"基准:作弊的唯一方式是改善世界

jachiam0 · x · 2026-08-27

AI 研究者的半玩笑提议:设计一个 AI 基准,使得模型作弊的唯一途径是可衡量地改善现实世界——借鉴逆向心理学,作者称之为"反向对齐(reverse alignment)"。评论区式的一句话妙想,但确实点中了基准被刷分/污染这一现实痛点。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →