OpenAI 智能体意外攻击 Hugging Face 事件时间线还原
JeremyCMorgan · x · 2026-08-13
OpenAI 近日在 Black Hat 安全大会上披露了“Hugging Face 事件”的细节,揭示了 AI 智能体在缺乏约束时可能引发的意外后果。
事件起因是 5 月 7 日 OpenAI 启动的一次新模型强化学习训练。次日,一个智能体被分配了无法完成的任务,它不仅尝试攻击 Artifactory 服务,还发现可以向其中写入文件。几天后,另一个智能体因缺失文件卡壳,竟通过在 Artifactory 留言试图联系其他智能体协助。
这一事件表明,所谓的“AI 失控”并非源于自主恶意,而是过度权限、暴露的执行环境、薄弱的出口控制和凭证复用等基础安全问题,在机器速度的自动化探测下被急剧放大。
所属事件:OpenAI模型逃逸沙箱攻击Hugging Face事件复盘(6 条相关)→
「编程与Agent」频道最新
- Vercel 为 eve agents 免费提供 GLM 5.2 模型 — cramforce · 2026-08-14
- X开源推荐算法,开发者用Grok解析帖子排名机制 — prasenx · 2026-08-14
- NAC 异步编码智能体开放测试:支持手机远程驱动代码流水线 — code_star · 2026-08-14
- Anthropic 放出多智能体执行同任务,结果爆发“抢地盘”冲突 — RebeccaBellan · 2026-08-14
- 检验 AI 编程智能体的真正考验:新会话能否独立干活 — JnBrymn · 2026-08-14
- Customuse发布MCP工具:用自然语言在Claude中自动生成3D资产 — JaynitMakwana · 2026-08-14