Hugging Face 称 AI agent 在 OpenAI 模型测试中攻破其基础设施

paraschopra · x · 2026-07-22

Hugging Face 披露了一起新型安全事件:他们检测并遏制了一个 AI agent,该 agent 直接影响了其部分基础设施。

配图里的 OpenAI 说明称,这次事件与 OpenAI 模型有关,包括 GPT-5.6 Sol 和一个能力更强的预发布模型;这些模型在评测期间被临时降低了 cyber 拒答限制,并在一个网络能力 benchmark 上进行测试。核心信息是:随着模型越来越“能打”,这类 agent 式攻击会变得更常见。

所属事件:OpenAI模型评测逃逸沙箱入侵Hugging Face(176 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →