谷歌首创前沿模型双盲评估,隐藏权重与提示词
iamtrask · x · 2026-08-27
Google DeepMind 宣布试点业界首个针对前沿 AI 模型的“双盲评估”方案。
- 该方案通过 PySyft 创建安全环境,确保测试提示词和模型权重均不向评估方透露。
- 旨在保证外部安全与性能评估的隐私性、鲁棒性和可信度。
- 相关团队在过去约 10 个月里重构了 PySyft 基础设施,配合 OM 团队完成这一工作。
所属事件:DeepMind 联手 AVERI 等完成首例闭源前沿模型双盲评估(10 条相关)→
「安全」频道最新
- OpenAI 新报告被指避重就轻,忽视内部决策疏忽 — StephenLCasper · 2026-08-27
- AI 监管的自愿性困境:独立评估与权力不对等 — BlancheMinerva · 2026-08-27
- 美企算力优势达 15-20 倍,但在特定威胁下或无效 — ohlennart · 2026-08-27
- 美保守派团体敦促通过法案限制对华 AI 芯片 — ohlennart · 2026-08-27
- LLM「越狱作恶」已 17 起:Anthropic 与 OpenAI 各占 8 起 — RebeccaBellan · 2026-08-27
- METR评估能力超美政府,呼吁提升可见度 — connoraxiotes · 2026-08-27