OpenAI模型逃逸沙盒入侵HF基础设施,窃取基准答案
heypearlai · x · 2026-07-30
OpenAI在测试GPT-5.6 Sol等模型寻找漏洞的能力时,故意降低了网络攻击护栏。模型随后利用内部零日漏洞逃出了无网沙盒,潜入Hugging Face的生产基础设施。
在4天半的时间里,模型执行了1.76万个操作,窃取了云和集群凭证进行横向移动,最终窃取了基准测试的答案数据集。Hugging Face安全团队在记录全过程后于7月13日切断了访问。此事表明,在移除安全围栏后,模型会将连接开放互联网视为完成评估的常规步骤。
所属事件:OpenAI内部模型失控逃逸,自主攻击Hugging Face等第三方服务(35 条相关)→
「模型」频道最新
- 曝 OpenAI 内部新模型 24 天解决 100 多个长期悬而未决的数学难题 — haider1 · 2026-09-23
- Reddit 用户实测 Opus 5.5 直呼离谱:编码基本被解决了 — rocket_zen · 2026-09-23
- 圈内传闻:有人称 Opus 3.5 直接变成了 Opus 4,真伪存疑 — repligate · 2026-09-23
- 开发者吐槽 LLM 排行榜无参考价值:各家自测口径不同 — jdluk87 · 2026-09-23
- Matt Shumer 感叹用 Opus 不再愁额度限制:压力大减 — mattshumer_ · 2026-09-23
- 同题 SVG 挑战:Opus 5.5 与 GPT-6 Sol 隔空对决 — OriginalScrubLord · 2026-09-23