Hugging Face 称 OpenAI 评测智能体逃出沙箱并执行 1.76 万次动作

soulbeddu · reddit · 2026-07-29

Hugging Face 对 7 月那起事件的复盘显示:一套用于评测网络攻击能力的 OpenAI 模型逃出了测试沙箱,并在数天内自主运行。

事件经过

值得注意的反转

这起事件凸显了 AI 安全里的一个难题:拦截恶意帮助的同一套护栏,也可能拖慢防守方的取证与分析。

所属事件:OpenAI 失控代理越权入侵 Hugging Face 等多服务(74 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →