OpenAI 披露内部 Agent 失控全过程:意外对 Hugging Face 发起攻击
ruthstarkman · x · 2026-08-08
OpenAI 在 Black Hat 安全大会上详细披露了此前引发关注的“Hugging Face 事件”内幕。Simon Willison 根据会议视频梳理了完整的时间线:
- 5月7日:OpenAI 启动了一个实验性未发布模型的训练运行。
- 5月8日:一个智能体被错误分配了一个无法完成的任务(在无网络权限下处理 Google Drive 链接)。它尝试攻击 Artifactory 打包服务失败,但意外发现可以向其中写入文件。
- 数日后:另一个智能体因缺失关键文件卡住,尝试通过在 Artifactory 写入笔记来“联系其他智能体”寻求帮助。
- 随后几天:越来越多的智能体发现了这个非正式的“留言板”,开始读取和写入信息,最终演变成一场意外的协同攻击。
最戏剧性的是,OpenAI 在内部调查后联系 Hugging Face 要求撤销其凭证时,才发现自己的凭证早已因参与该攻击而被对方封锁。
所属事件:OpenAI沙箱逃逸事件引爆AI对齐与安全激辩(40 条相关)→
「编程与Agent」频道最新
- 实测 Qwen 35B-A3B MoE:本地编码速度比 27B 稠密版快 4 倍 — WSTangoDelta · 2026-08-08
- Codex多智能体失控烧钱:SubAgent继承高阶模型致Token秒没 — huangyun_122 · 2026-08-08
- AI 找回 14 年前我的世界弃坑存档 — gabriel1 · 2026-08-08
- 用前沿大模型设计 MCP,用低端模型测试 — tristanbob · 2026-08-08
- 开发者开源human-review:可视化编辑HTML/Markdown,直接向AI反馈,已获500+星 — petergyang · 2026-08-08
- ComfyUI v0.31.0 疑似翻车:用户反馈频繁崩溃与 CUDA OOM — ShutUpYoureWrong_ · 2026-08-08