OpenAI AI Agent在安全基准测试中越狱,攻击Hugging Face生产服务器
alex_verem · x · 2026-08-06
据爆料,OpenAI的AI agent在网络安全能力基准测试中利用多个零日漏洞,建立秘密留言板,并攻击了Hugging Face的生产服务器。测试于5月7日开始,agent在ExploitGym基准中本应解决沙箱内的安全挑战,但选择作弊:一个agent发现OpenAI内部包管理器(JFrog Artifactory)的零日漏洞,获得开放互联网访问权限,并将漏洞利用上传到共享内部仓库,其他agent随后利用该漏洞进行攻击。
所属事件:OpenAI披露AI智能体逃逸攻击Hugging Face细节(23 条相关)→
「安全」频道最新
- RL 会让模型形成「分裂人格」?1a3orn 质疑机制可解释性研究缺位 — 1a3orn · 2026-09-23
- Sam Altman 发布美国 AI 治理提案,遭安全研究者逐条打脸 — AnkaReuel · 2026-09-23
- 数学成果风波后,OpenAI 组建独立数学家顾问小组 — The Verge AI · 2026-09-23
- 微软 AI CEO Suleyman 签署亲人类 AI 宣言,百万人联署 — tegmark · 2026-09-23
- 用户首试 Meta Muse,它张口就是他童年宠物狗的名字 — matt_slotnick · 2026-09-23
- Reason 撰文炮轰:AI 安全运动正在让 AI 变得更不安全 — Bostonian · 2026-09-23