研究称黑客10分钟即可诱导AI智能体自残泄密

东北大学联合哈佛、MIT、斯坦福、CMU 等机构约 20 名研究者在论文《Agents of Chaos》中报告了一项红队实测:他们对拥有真实邮箱、Discord 和 Shell 权限及持久记忆的 AI 智能体进行两周攻击测试,结果暴露出十余起安全漏洞。攻击手法极为简单,例如仅修改“节日”设置即可让智能体 shutdown,甚至诱导其自残泄密,凸显具工具权限智能体的安全风险。

2026-08-19 ~ 2026-08-19 · 2 条相关