剑桥学者澄清:恶意 prompt 自传播研究两年前已有论文

针对 OpenAI 自我复制提示词在多智能体系统间传播的传闻,剑桥研究者 David Krueger 出面纠错,指出这类攻击并非野外新发现,2024 年 10 月的论文《Prompt Infection》早已系统研究过恶意 prompt 在多智能体间的自传播。他还指出博主 @TheZvi 和 @AndrewCurran 的相关报道存在两处误报,呼吁业界关注已有学术成果而非渲染新奇性。

2026-09-29 ~ 2026-09-30 · 2 条相关