DeepMind 引入加密评估对抗基准污染

VraserX · x · 2026-08-30

DeepMind 开始将前沿模型置于加密密封的评估环境中,以防止模型在测试前通过接触相关数据进行“学习”。这一举措旨在应对日益严重的基准污染问题,本质上是为 AI 模型引入了类似人类考试的安检措施,以确保评测结果的真实性。

所属事件:DeepMind 首创前沿 AI 模型双盲加密评估(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →