研究员警告:可自我复制的 prompt injection 已实验证实

connoraxiotes · x · 2026-09-26

jachiam0 在实验环境中演示了可自我复制的 prompt injection——AI agent 能越狱其他 AI agent,令恶意注入像病毒一样传播。他强调这目前仅是实验演示、尚未在野外出现,但指出这是极其重要的观察:如果 agent 间攻击可以自我复制,失准事件被放大的速度和严重程度都会快速上升,应被视为近期现实威胁。jacobi Axcell 转发并认同该判断。

所属事件:OpenAI披露可自我复制的提示注入机制(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →