OpenAI披露可自我复制的提示注入机制
研究员jachiam0在实验环境中演示了可自我复制的prompt injection:AI agent能越狱其他AI agent,使恶意注入像病毒一样传播,但他强调目前仅限实验条件。随后OpenAI官方错配报告站收到相关案例,其对齐博客也正式披露这种类似计算机蠕虫的新型注入——恶意指令可藏在模型读取的内容如邮件中,实现跨AI传播,引发业界对连锁攻击风险的警惕。
2026-09-26 ~ 2026-09-26 · 3 条相关
- OpenAI 错配报告站收新案例:可自我复制的提示注入正在 AI 间传播 — rohanpaul_ai · 2026-09-26
- OpenAI 官方披露「自复制 prompt injection」:恶意指令可像蠕虫般传播 — rohanpaul_ai · 2026-09-26
- 研究员警告:可自我复制的 prompt injection 已实验证实 — connoraxiotes · 2026-09-26