安全研究者:多智能体间 prompt 传播两年前就有论文实锤

DavidSKrueger · x · 2026-09-29

剑桥研究者 David Krueger 回应关于「恶意 prompt 在多智能体系统间自传播」的传闻:这类攻击并非新事,2024 年 10 月的论文《Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems》已经系统演示了恶意 prompt 像病毒一样在互联 agent 间自我复制,可导致数据窃取、诈骗与系统性破坏,并提出 LLM Tagging 作为缓解手段。他认为 OpenAI 目前只是承认「这种可能性存在」,而学界两年前就已实锤。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →