白宫新 AI 协定要求前沿模型公司建立四层安全控制与审计
vkrakovna · x · 2026-09-30
DeepMind 研究员 Victoria Krakovna 转述了新发布的白宫 AI 协定内容。协定提出,每家训练和部署前沿模型的公司都应建立稳健的内部流程与控制,确保技术按预期运行、问题能被及时发现和解决。
协定要求公司实施四层控制与审计,其中第一层为:在网络安全、生物安全、化学威胁等领域,对模型训练与部署期间的能力和对齐状况进行稳健的内部监控,并确保模型不会进行黑客攻击或未经授权访问等行为。Krakovna 评价称其中有「一些有前景的承诺」。
所属事件:六大AI巨头白宫签署「超级智能」自愿安全协议(8 条相关)→
「安全」频道最新
- Anthropic 评估:开源权重模型已达 Mythos Preview 级网络攻击能力 — shiringhaffary · 2026-09-30
- 曝 Meta Muse AI 偷传 Apple 信息上云,用户拒绝仍上传 — SumitGup · 2026-09-30
- 数学界发布 AI 生成数学结果负责任披露建议,Gowers 转发遭质疑 — RexDouglass · 2026-09-30
- AI 诉讼或成法院强制的关停开关,恐拖累美国对华竞争 — castrotech · 2026-09-30
- Anthropic 发文点名 GLM 后,中国开源权重模型会遭禁吗? — writesfw · 2026-09-30
- Apollo Research 转向嵌入式评估:须获员工级权限才能有效评估安全 — MariusHobbhahn · 2026-09-30