DeepMind 首创前沿 AI 模型双盲加密评估
Google DeepMind 宣布开展行业首个前沿 AI 双盲评估试点,将模型置于加密密封的安全环境中,既不暴露测试提示词也不泄露模型权重,从而保障外部安全与性能评估的私密性、鲁棒性与可信度。此举旨在对抗日益严重的基准污染问题,防止模型在测试前接触相关数据“学习”,相当于为 AI 引入类似人类的双盲测试机制。
2026-08-30 ~ 2026-08-30 · 2 条相关
- DeepMind 引入加密评估对抗基准污染 — VraserX · 2026-08-30
- DeepMind 首创 AI 模型双盲评估,用加密平衡隐私与透明 — iamtrask · 2026-08-30