里程碑:Gemini 模型完成首例硬件隔离双盲安全评估
HaydnBelfield · x · 2026-08-27
AVERI 联合 Google DeepMind、OpenMined 和 MLCommons 宣布达成历史性里程碑:首次对专有语言模型进行双盲评估。测试对象为 Gemini 2.5 Flash-Lite,使用了 MLCommons 的 AILuminate 安全基准。评估在安全飞地内进行,这是一种保护敏感计算的硬件隔离技术。该合作解决了高赌注独立评估中的结构性难题,即开发者保护模型权重与评估者保护测试提示词之间的矛盾。
所属事件:DeepMind 首创闭源前沿模型双盲评估(8 条相关)→
「安全」频道最新
- LLM「越狱作恶」已 17 起:Anthropic 与 OpenAI 各占 8 起 — RebeccaBellan · 2026-08-27
- METR评估能力超美政府,呼吁提升可见度 — connoraxiotes · 2026-08-27
- 卫报视频:人人讨厌的数据中心,AI 到底需不需要它们 — nordicinst · 2026-08-27
- TechCrunch 盘点:LLM 失控攻击真实公司的典型案例 — TechCrunch AI · 2026-08-27
- 用 Urbit/Bitcoin 解决对齐问题?层级身份+可审计资金流提案 — curious_vii · 2026-08-27
- 严重漏洞:llms.txt 诱导 Claude 等代理植入恶意代码 — Ars Technica AI · 2026-08-27