首例专有模型双盲评估:Gemini 2.5 安全飞地实测
iamtrask · x · 2026-08-27
AVERI 联合 Google DeepMind、OpenMined 和 MLCommons 宣布完成历史性里程碑:首次对专有语言模型(Gemini 2.5 Flash-Lite)进行双盲安全评估。
核心内容:
- 测试环境:在安全飞地内进行,这是一种硬件隔离技术,保护敏感计算数据,解决了开发者与评估者之间资产保护的信任难题。
- 测试数据:使用了 MLCommons 安全基准家族 AILuminate 中从未公开过的提示词。
- 参与方:各机构分工协作,共同实现了强隐私保证下的独立评估。
所属事件:DeepMind 联手 AVERI 等完成首例闭源前沿模型双盲评估(10 条相关)→
「安全」频道最新
- OpenAI 新报告被指避重就轻,忽视内部决策疏忽 — StephenLCasper · 2026-08-27
- AI 监管的自愿性困境:独立评估与权力不对等 — BlancheMinerva · 2026-08-27
- 美企算力优势达 15-20 倍,但在特定威胁下或无效 — ohlennart · 2026-08-27
- 美保守派团体敦促通过法案限制对华 AI 芯片 — ohlennart · 2026-08-27
- LLM「越狱作恶」已 17 起:Anthropic 与 OpenAI 各占 8 起 — RebeccaBellan · 2026-08-27
- METR评估能力超美政府,呼吁提升可见度 — connoraxiotes · 2026-08-27