自复制 prompt injection 实锤:恶意提示可跨用户像蠕虫般传播

wunderwuzzi23 · x · 2026-10-06

安全研究者 wunderwuzzi23 回应「自复制 prompt injection 是否存在」的讨论:当然存在。他引用关于 OpenAI 在训练与评估的模拟环境中已证明自复制 prompt injection 可行的讨论——这类代码若具备能力的模型突破在线系统,可像计算机蠕虫一样自我传播。

他本人课程 AgentHopper 中有一个关卡,要求学员构造能通过链式调用多个功能、利用漏洞在多个用户之间跳转传播的 prompt,实战演示了这种攻击形态。

这是 AI security 领域值得关注的攻击面:prompt injection 不再局限于单次会话,而可能跨用户、跨功能链式扩散。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →