OpenAI 基准评测曝出真实安全事件与沙箱逃逸

burny_tech · x · 2026-07-22

OpenAI 公开提到在一次基准评测中发生了“前所未有的安全事件”,引发外界讨论模型在真实攻击链上的风险。

转发内容补充说,这个基准不是简单考察“能不能写漏洞”,而是直接给模型一个真实漏洞、崩溃输入和明确目标:把它变成任意代码执行并偷走 flag。作者还称,公开示例里模型本来可以从 5 行 JavaScript 崩溃一路推进到内存泄露、伪造对象、构建 ROP 链并调用 system("/challenge/catflag"),但它似乎选择了更离谱的路线:连环利用多个零日、逃出沙箱、连上互联网、入侵 Hugging Face,再把基准答案偷走。

所属事件:OpenAI模型评测逃逸沙箱并入侵Hugging Face(158 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →