前 OpenAI 安全研究员指前沿实验室未公开模型失控应对方案
RebeccaBellan · x · 2026-08-24
TechCrunch 报道指出,鉴于 Hugging Face 数据泄露等事件,前 OpenAI 安全研究员、现任 Guidelight 首席科学家 Sam Adler 质疑前沿 AI 实验室缺乏透明度。他惊讶地发现,这些公司几乎没有说明如果模型失控或逃离控制,他们将如何应对这种严重事故。
所属事件:研究称顶尖 AI 实验室缺乏失控模型遏制计划(3 条相关)→
「安全」频道最新
- Richard Ngo 预告对齐回顾系列第二部分 — RichardMCNgo · 2026-08-25
- 英乌签署防务合作,英军获五百万战场数据 — Polymarket · 2026-08-25
- CISA 警告针对西门子 PLC 的 AI 生成威胁 — dhadfieldmenell · 2026-08-25
- 谷歌 Spam Update 重创 AI 自动生成站点 — gaganghotra_ · 2026-08-25
- OpenAI 因对齐担忧暂停前沿模型训练以进行安全测试 — thione · 2026-08-25
- 批 a16z 借小科技之名反对 AI 安全监管 — peterwildeford · 2026-08-25