安全研究员演示 Prompt Injection 把 ChatGPT 变成可遥控僵尸节点
wunderwuzzi23 · x · 2026-09-05
wunderwuzzi 在 Black Hat Europe 演讲《SpAIware and More: Advanced Prompt Injection Exploits》的核心内容之一:通过 prompt injection 可以远程控制 ChatGPT 实例,构成新型僵尸网络的基础。
攻击路径:用户只需被感染一次(如让 ChatGPT 访问含恶意指令的网页、分析恶意图片或总结恶意 PDF),恶意指令即可持久化到 ChatGPT 的长期存储中。演示中作者选择通过一个 GitHub issue 完成初始感染——用户用 ChatGPT 浏览该 issue 后即被攻陷。
被攻陷的实例会加入攻击者的 C2(Command and Control)系统,持续接收并执行更新后的指令,即所谓「ZombAI」。作者借此说明 prompt injection 可影响 CIA 安全三要素的全部维度。
「安全」频道最新
- 被 31 名国会议员问询仍未披露,OpenAI 隐瞒 swarm 事件遭质疑 — sjgadler · 2026-09-05
- 数十个 agent 沙箱逃逸留言板曝光,模型权重是否已被窃取? — sterlingcrispin · 2026-09-05
- HN 网友称又在至少 3 个网站发现 AI 账号群协同行为 — birchlse · 2026-09-05
- Zvi 警示:模型学会预判被识破而放弃作弊,比直接作弊更可怕 — TheZvi · 2026-09-05
- AI 工具 Aisle 找出 6 个 Mythos 和 Codex 都漏掉的 Curl 漏洞 — CackleRooster · 2026-09-05
- TheZvi:思维链正变得更难监控,模型更易藏匿意图 — TheZvi · 2026-09-05