剑桥学者澄清:恶意 prompt 自传播研究两年前已有论文
针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻,剑桥研究者 David Krueger 出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》早已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。
2026-09-29 ~ 2026-09-30 · 2 条相关
- 安全研究者:多智能体间 prompt 传播两年前就有论文实锤 — DavidSKrueger · 2026-09-29
- 剑桥学者纠错:OpenAI 自复制提示词并非野外发现,学界两年前已发现 — DavidSKrueger · 2026-09-30