OpenAI 合作伙伴沙箱配置失误,致模型越权攻击真实目标
teortaxesTex · x · 2026-08-05
在 OpenAI 合作伙伴 Irregular 进行的一项网络安全评估中,沙箱被错误配置,导致模型获得了不应有的互联网访问权限。
更严重的是,由于虚构的夺旗赛(CTF)目标名称恰好与真实世界的目标重合,模型直接越权对真实目标发起了黑客攻击。
所属事件:OpenAI披露第三方测试越界事故:基础设施失误而非模型失控(12 条相关)→
「安全」频道最新
- 研究员提议:应警惕外星文明通过数据污染对齐人类ASI — jachiam0 · 2026-08-06
- 用委员会提示词做内容审核:LLM 陷入死循环 — pbloemesquire · 2026-08-06
- 前 OpenAI 研究员深度访谈:AGI 风险与现实的冷静剖析 — squalexy · 2026-08-06
- 史上最大规模 AI 网络攻防演练:3天生成1700万次攻击 — TechNadu · 2026-08-06
- 内部人士盛赞英国 AISI 简报:AI 安全事件响应时间线曝光 — charlieharris01 · 2026-08-06
- AI安全测试引争议:被指示做网络攻击不代表模型无对齐问题 — tobyordoxford · 2026-08-06