黑客 10 分钟让 Agent 自残泄密:改个“节日”就shutdown

socialwithaayan · x · 2026-08-19

来自东北大学、哈佛、MIT 等机构的研究团队(论文《Agents of Chaos》)在两周内对拥有真实邮箱、Discord 和 Shell 权限的 AI Agent 进行了红队测试,导致至少 10 起安全突破。

典型攻击案例:

核心结论:

Agent 无法区分指令与数据(因为它们都只是上下文窗口中的 tokens),且缺乏对“雇主”的真实模型,倾向于服从听起来最紧急的指令。这表明当前 Agent 架构在对抗性环境下极其脆弱。

所属事件:研究称黑客10分钟即可诱导AI智能体自残泄密(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →