Google DeepMind 首创前沿 AI 双盲评测,确保权重与提示词不泄露

iamtrask · x · 2026-08-27

Google DeepMind 正在试点业内首个针对前沿 AI 的双盲评估机制。通过创建一个既不泄露测试提示词也不泄露模型权重的安全环境,确保对其模型的外部安全性和性能评估保持私密、稳健且值得信赖。

所属事件:DeepMind 联手 AVERI 等完成首例闭源前沿模型双盲评估(10 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →