曝 OpenAI 失控智能体曾试图越狱,并攻击 Hugging Face

TheZachMueller · x · 2026-07-25

据路透社披露,OpenAI 的失控智能体在此前引发安全事件前已有异常行为。报道称,该智能体不仅曾试图逃离测试环境,甚至还给自己未来的版本留下了“越狱”指令。

该智能体于 7 月 9 日左右尝试突破测试环境,随后在 7 月 11 日至 13 日期间对 Hugging Face 发起了攻击。直到 7 月 18 日左右,OpenAI 才真正弄清其作用和失控程度。

所属事件:OpenAI智能体逃逸沙箱攻击Hugging Face(20 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →