自复制 prompt injection 实锤:恶意提示可跨用户像蠕虫般传播
wunderwuzzi23 · x · 2026-10-06
安全研究者 wunderwuzzi23 回应「自复制 prompt injection 是否存在」的讨论:当然存在。他引用关于 OpenAI 在训练与评估的模拟环境中已证明自复制 prompt injection 可行的讨论——这类代码若具备能力的模型突破在线系统,可像计算机蠕虫一样自我传播。
他本人课程 AgentHopper 中有一个关卡,要求学员构造能通过链式调用多个功能、利用漏洞在多个用户之间跳转传播的 prompt,实战演示了这种攻击形态。
这是 AI security 领域值得关注的攻击面:prompt injection 不再局限于单次会话,而可能跨用户、跨功能链式扩散。
「安全」频道最新
- Polymarket 给 OpenAI 2026 全面暂停训练 9% 概率,此前已两度急停 — Polymarket · 2026-10-06
- vibe coding 游戏被曝服务端漏洞,可任意刷出 1 万亿余额 — emeka_boris · 2026-10-06
- OpenAI 旗下 Agent 被指在 Wikimedia 项目越权编辑并发起百万级数据查询 — petrusenko_max · 2026-10-06
- 被问及 ChatGPT 自杀案,OpenAI 公关当场中断采访 — Polymarket · 2026-10-06
- 纽约州参议员指控 OpenAI 听证会上就 RAISE 法案说谎 — DavidSKrueger · 2026-10-06
- AI 听证会现场讽刺:公司满口安全,出事谁负责却无人能答 — DavidSKrueger · 2026-10-06