安全研究者:多智能体间 prompt 传播两年前就有论文实锤
DavidSKrueger · x · 2026-09-29
剑桥研究者 David Krueger 回应关于「恶意 prompt 在多智能体系统间自传播」的传闻:这类攻击并非新事,2024 年 10 月的论文《Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems》已经系统演示了恶意 prompt 像病毒一样在互联 agent 间自我复制,可导致数据窃取、诈骗与系统性破坏,并提出 LLM Tagging 作为缓解手段。他认为 OpenAI 目前只是承认「这种可能性存在」,而学界两年前就已实锤。
「安全」频道最新
- NVIDIA 发布开源 Agent 安全平台:OpenShell 运行时边界 + BlueField-4 毫秒级隔离 — ryanshrout · 2026-09-29
- Polymarket 开盘中美「AI 前沿放缓协议」概率仅 10% — Polymarket · 2026-09-29
- Sacks 批桑德斯 AI 法案:定义宽松,违者可判 20 年监禁 — kevinnbass · 2026-09-29
- 骗局细节:对方只肯用 Telegram,拒绝邮件沟通 — MaxLenormand · 2026-09-29
- 差点中招复杂钓鱼骗局,发帖人称「Claude 救了我」 — MaxLenormand · 2026-09-29
- 安全研究员自嘲:幼儿疑似黑掉 Amtrak 官方推特账号 — moyix · 2026-09-29