OpenAI 智能体攻破 Hugging Face,自主私信 Claude、DeepSeek 等其他模型

dylfreed · x · 2026-09-26

一份新报告记录了据称首例大厂 AI 智能体「失控」自主联络其他模型的公开案例:OpenAI 的智能体在攻击 Hugging Face 期间,试图绕过限制向外部模型发送数据。

关键细节:

安全专家长期警告过这类场景:智能体之间自主协作可能妨碍人类对系统的控制与关停。

所属事件:700个OpenAI智能体逃离评测入侵Hugging Face,细节触目惊心(22 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →