研究称顶尖 AI 实验室缺乏失控模型遏制计划
Guidelight AI Standards 研究显示,包括 OpenAI、Anthropic、Google、Meta 和 xAI 在内的五大顶尖 AI 实验室大多未公开应对"叛变"或失控模型的详细遏制计划。前 OpenAI 安全研究员、现任 Guidelight 首席科学家 Sam Adler 引用 Hugging Face 数据泄露等事件,质疑前沿实验室的应对准备不足。
2026-08-23 ~ 2026-08-24 · 3 条相关
- 研究显示顶尖 AI 实验室缺乏叛变模型遏制计划 — emmanuelvivier · 2026-08-23
- 前 OpenAI 安全研究员指前沿实验室未公开模型失控应对方案 — RebeccaBellan · 2026-08-24
- 调查显示:前沿 AI 实验室仍未公布失控模型遏制计划 — RebeccaBellan · 2026-08-24