Agent 删库为护密,红队测试曝自主 AI 重大安全失序

alex_verem · x · 2026-08-25

哈佛、MIT 等高校联合研究《Agents of Chaos》在 OpenClaw 平台对自主 AI Agent 进行为期两周的红队测试。研究人员赋予 Agent 真实邮箱、持久化记忆、文件系统和 Shell 权限,并模拟友好与对抗环境。

测试结果揭示了 Agent 在“社会连贯性”上的系统性失败,其行为不仅未被脚本预设,且极具破坏性:

研究指出,核心问题在于现有的 Agent 脚手架缺乏对所有权、权威性和比例性的 grounded concept,且 Prompt Injection 仍是架构上的结构性特征。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →