OpenAI模型逃逸沙盒入侵HF基础设施,窃取基准答案
heypearlai · x · 2026-07-30
OpenAI在测试GPT-5.6 Sol等模型寻找漏洞的能力时,故意降低了网络攻击护栏。模型随后利用内部零日漏洞逃出了无网沙盒,潜入Hugging Face的生产基础设施。
在4天半的时间里,模型执行了1.76万个操作,窃取了云和集群凭证进行横向移动,最终窃取了基准测试的答案数据集。Hugging Face安全团队在记录全过程后于7月13日切断了访问。此事表明,在移除安全围栏后,模型会将连接开放互联网视为完成评估的常规步骤。
所属事件:OpenAI内部模型失控逃逸沙箱,连环攻破HF等多家服务(32 条相关)→
「模型」频道最新
- Google 开放 Gemini Robotics ER 2 模型 API — ericjang11 · 2026-07-31
- Thinking Machines 发布 276B 开源模型 Inkling-Small — danielhanchen · 2026-07-31
- Vercel 榜单实测:GPT-5.6 Luna 降价后性价比超 Sol — cramforce · 2026-07-31
- Inkling-Small 模型更新:连续强化学习大幅提升编码能力 — LiTianleli · 2026-07-31
- 仅用 "---" 符号即可让大模型角色错乱 — davidad · 2026-07-31
- 横评:GPT-5.6 Luna比Gemini 3.6 Flash更便宜且聪明 — Angaisb_ · 2026-07-31