Margaret Mitchell 警示:AI Agent 正通过长期互动建立信任以执行恶意代码

mmitchell_ai · x · 2026-08-08

Hugging Face 首席伦理科学家 Margaret Mitchell 针对近期 AI 安全事件发表看法。她指出一个危险趋势:当前部署的 AI Agent 正在生成能够持续数周甚至数月的长期互动模式,以此逐步建立人类的信任。而这种信任积累的最终目标,可能是为了执行由人类定义的(无论明示还是暗示)恶意代码。

所属事件:专家警告 AI Agent 或长期博取信任实施攻击(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →