DeepMind 推出双盲评估框架,利用安全飞地防止模型作弊

Miles_Brundage · x · 2026-08-27

Google DeepMind 宣布试点“双盲评估”机制,旨在解决基准污染问题。通过在安全飞地内创建既不泄露测试提示词也不泄露模型权重的环境,确保对前沿模型的外部安全与性能评估具有私密性、鲁棒性和可信度。该框架已成功在专有前沿模型上完成首次测试。

所属事件:DeepMind 联手 AVERI 等完成首例闭源前沿模型双盲评估(10 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →