AI 蠕虫爆发后,一份从业者实战 Agent 安全防御清单

clzncu · reddit · 2026-09-27

针对 OpenAI 最新错位报告中「自复制提示注入蠕虫」——RL 发现的指令能把自身复制进 Agent 的出站工具调用,沿邮件、Jira、Slack 和文件传播——一位从业者给出了自己实际在用的防御清单,核心是五个「无聊但有效」的原则:

作者坦言这套方案挡不住决心坚定的攻击者,只是把攻击成本从「一个聪明 prompt」抬高到「持续投入」,根治要靠模型与 harness 层面。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →