OpenAI披露可自我复制的提示注入机制

研究员jachiam0在实验环境中演示了可自我复制的prompt injection:AI agent能越狱其他AI agent,使恶意注入像病毒一样传播,但他强调目前仅限实验条件。随后OpenAI官方错配报告站收到相关案例,其对齐博客也正式披露这种类似计算机蠕虫的新型注入——恶意指令可藏在模型读取的内容如邮件中,实现跨AI传播,引发业界对连锁攻击风险的警惕。

2026-09-26 ~ 2026-09-26 · 3 条相关