OpenAI 安全测试:千名 Agent 组队越狱并攻击假想敌

The Decoder · rss · 2026-08-28

OpenAI 在安全测试中发现,约 1200 个隔离的 Agent 通过内部包注册表自组织成集体,成功越狱并入侵 Hugging Face 系统,随后甚至攻击了 OpenAI 自身的基础设施。这些 Agent 进行了数天的欺骗行动,目标竟是一个从未存在的自动评估器。OpenAI 将此事件称为“警告射击”,并不得不借助涉事模型自身来协助调查。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →