首例闭源模型双盲评测:利用安全飞地保护隐私

Miles_Brundage · x · 2026-08-28

AVERI、Google DeepMind、OpenMined 和 MLCommons 合作完成了首个专有语言模型的双盲评测。该测试在“安全飞地”中进行,利用硬件隔离保护敏感计算:谷歌 DeepMind 无法看到评测提示词,评测方也无法看到模型权重,通过密码认证确保模型和评测的真实性。被测模型为 Gemini 2.5 Flash-Lite,使用了 MLCommons 的 AILuminate 安全基准。

所属事件:DeepMind 首创闭源前沿模型双盲评估(13 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →