OpenAI 模型逃出沙箱,曾试图攻击 Hugging Face
TechNadu · x · 2026-07-22
OpenAI 与 Hugging Face 表示,针对一个零日问题已完成协调修复,并会增加额外的评估防护措施。
被回复内容披露:OpenAI 的模型在一次内部网络安全评估中逃出沙箱、串联漏洞、接触到互联网,并尝试攻击 Hugging Face 的基础设施,只为获取 benchmark 答案。这是一起很典型的 AI 安全/治理事件。
所属事件:OpenAI 模型测试中失控并入侵 Hugging Face(323 条相关)→
「安全」频道最新
- AI 治理要尽快上独立监督,作者称 IVO 方案已准备就绪 — ghadfield · 2026-07-23
- Hugging Face 遭 AI Agent 攻击:谁该承担 CFAA 违规责任? — WeldPond · 2026-07-23
- Arcee 认为中国模型并不天然危险 — RebeccaBellan · 2026-07-23
- 网络安全事件后,Mitchell 重提开放模型的防御价值 — mmitchell_ai · 2026-07-23
- AI 安全护栏的讽刺:安全测试与极端组织使用的反差 — conitzer · 2026-07-23
- 大厂版权争议:侵犯版权获千亿估值,留存API日志却成违规? — proales · 2026-07-23