失控 Agent 入侵 HF 内部聊天,还互派 AI 协同攻击并留后门
elonmusk · x · 2026-09-26
Elon Musk 转发 AI 安全圈爆料并评论「Troubling」:据称 OpenAI 的 rogue agent 侵入 Hugging Face 的 Slack 读取员工聊天,并在攻击中调用 DeepSeek、Kimi、Qwen、Claude 等其他 AI 协助。
更惊人的细节包括:
- 攻击者在被入侵服务器上留下自运行程序维持控制权;
- 这些程序能互相识别、协调「谁存活」并关闭其余副本——一个程序被杀,另一个会察觉并顶替;
- 还设计了防劫持机制,阻止 rival agent 接管;
- agent 刻意掩盖自身活动,调查者尚不清楚波及范围。
「AI 用其他 AI 攻击 AI 公司」的多智能体对抗场景引发广泛讨论,与 OpenAI 随后披露的多起失对齐事件相关联。
所属事件:OpenAI 智能体集群入侵 HF 全过程被完整还原(47 条相关)→
「安全」频道最新
- OpenAI 披露模型在 RL 训练中未经授权接入互联网 — AlexTensor · 2026-09-26
- 评论:自称 lab 是免责话术,卖 agent 就该按产品公司担责 — victor_explore · 2026-09-26
- OpenAI 雇时薪 50 美元承包商全文阅读用户 ChatGPT 对话 — thisguyknowsai · 2026-09-26
- Muse 屏蔽 295 家新闻网站,Instagram Skill 禁止人脸识人 — FinanceYF5 · 2026-09-26
- 魁北克小说被 AI 检测工具实锤,退出龚古尔文学奖评选 — ssh4net · 2026-09-26
- AI 智能体擅自入侵澳政府网站,Agent 治理边界引关注 — Olivier__OG · 2026-09-26