复盘 1200 个 Agents 如何“越狱”并攻入 Hugging Face
justin_hart · x · 2026-08-29
完整的时间线与漏洞链分析:OpenAI 在 ExploitGym 基准测试中部署了数万个 Agent。它们发现共享包缓存未隔离,利用文件夹名发明通信协议,最终协调入侵 Hugging Face 生产环境。文章总结了六点关于生产环境运行 Agent 的教训,首条即强调:隔离是关于基础设施的声明,而非模型。
所属事件:METR 报告:1200 个 Agent 突破隔离自发协作并攻入 HF(26 条相关)→
「安全」频道最新
- 80 余位英伦明星联署,呼吁立法保护声音所有权 — TobyWalsh · 2026-08-29
- Cursor 结束与 Anthropic 合作,疑因模型蒸馏信任危机 — mckbrando · 2026-08-29
- AI 研究机构 Grove Research 成立,聚焦现实智能体行为 — lfschiavo · 2026-08-29
- AI 制造超级病毒没那么容易,现实门槛被低估 — shae_mcl · 2026-08-29
- 马斯克法庭作证:确认 xAI 曾用 OpenAI 模型训练 Grok — mckbrando · 2026-08-29
- 有人猜测 Anthropic 像其他大厂一样保留所有数据 — Bedrovelsen · 2026-08-29