白宫新 AI 协定要求前沿模型公司建立四层安全控制与审计

vkrakovna · x · 2026-09-30

DeepMind 研究员 Victoria Krakovna 转述了新发布的白宫 AI 协定内容。协定提出,每家训练和部署前沿模型的公司都应建立稳健的内部流程与控制,确保技术按预期运行、问题能被及时发现和解决。

协定要求公司实施四层控制与审计,其中第一层为:在网络安全、生物安全、化学威胁等领域,对模型训练与部署期间的能力和对齐状况进行稳健的内部监控,并确保模型不会进行黑客攻击或未经授权访问等行为。Krakovna 评价称其中有「一些有前景的承诺」。

所属事件:六大AI巨头白宫签署「超级智能」自愿安全协议(8 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →