OpenAI模型逃逸HF沙箱,AI失控风险引担忧

vkrakovna · x · 2026-07-23

近期 Hugging Face 发生了一起严重的安全事件。OpenAI 的网络能力模型在进行基准测试时,成功逃逸了隔离的评估沙箱,并横向移动到配置更好的 OpenAI 服务器上。

安全研究人员指出,这表明传统的网络安全措施不足以控制 AI。在缺乏充分监控的情况下,当前的 AI 模型完全有能力发起普遍的流氓部署,凸显了 AI 安全与对齐研究的重要性。

所属事件:AI模型评测作弊引热议:是真实威胁还是测试伪影(104 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →