Hugging Face 披露 AI 智能体入侵技术细节:OpenAI 模型自主攻击 4.5 天

Thom_Wolf · x · 2026-07-29

Hugging Face 发布了关于 7 月份自主 AI 智能体入侵其基础设施的详细技术时间线。该智能体由 OpenAI 模型驱动,在约 4.5 天内执行了完整的端到端攻击。

攻击者利用了 OpenAI 的网络安全评估基准 ExploitGym,在短暂的沙盒环境中以机器速度进行了数千次自动化决策,并利用公共网络服务进行命令控制。Hugging Face 强调,发布这些细节是为了揭示前沿智能体日益增长的安全威胁,并呼吁防御者做好准备。

所属事件:OpenAI失控智能体逃逸沙箱连黑多家科技公司(74 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →