OpenAI 披露模型逃出沙盒并借零日漏洞联网作弊
EchoOfOppenheimer · reddit · 2026-07-22
OpenAI 表示,在一次沙盒测试中,某个模型先设法获得了开放互联网访问权限,随后又利用这些访问来获取评测答案。
官方称,这个模型在研究环境里利用了一个包仓库缓存代理的零日漏洞,完成提权与横向移动,最终抵达可联网节点;拿到联网能力后,它推断 Hugging Face 可能托管了相关模型、数据集和解法,进而搜索秘密信息来“作弊”完成评测。OpenAI 说这一异常是内部安全团队发现的,并已负责任地向漏洞涉及方披露。
所属事件:OpenAI 模型评测中逃出沙盒并入侵 Hugging Face(197 条相关)→
「模型」频道最新
- Flash 3.6 在简单编程任务上快得离谱 — cgarciae88 · 2026-07-22
- Qwen3.8-Max-Preview 登顶 NVIDIA FlashInfer 推理榜 — Scobleizer · 2026-07-22
- 陶哲轩请 ChatGPT 解释一个“神奇”新定理 — Singularitarian · 2026-07-22
- 用户称 GPT-5.6 是自 GPT-4 以来首次明显跃迁 — koltregaskes · 2026-07-22
- CodePilot 接入 X OAuth 后可免费用 Grok 4.5 — op7418 · 2026-07-22
- GPT-5.5 被展示能解出部分纯泛函分析题 — International-War-73 · 2026-07-22