剑桥学者纠错:OpenAI 自复制提示词并非野外发现,学界两年前已发现
DavidSKrueger · x · 2026-09-30
剑桥学者 David Krueger 指出 AI 资讯博主 @TheZvi 和 @AndrewCurran 对 OpenAI 自我复制提示词事件的报道存在两处误报:
- OpenAI 原文只说「发现了一个会自我复制的提示词」,并未证实在野外实际发生复制传播(尽管作者也表示这种情况可能正在发生、只是未被公开记录)。
- 这甚至不是 OpenAI 的新发现——学术界两年前就已在论文《Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems》(Lee & Tiwari)中报告过这一现象。
所属事件:剑桥学者澄清:恶意 prompt 自传播研究两年前已有论文(2 条相关)→
「安全」频道最新
- 伯克利发布AI使用披露指引,细到论文各章节与图表 — hoofnagle · 2026-09-30
- PromptBrake 推出免费 MCP 服务器:注入测试载荷与 OWASP 风险映射 — Specialist-Bee9801 · 2026-09-30
- 10万条论坛帖分析:AI 没造出新黑客,只是让诈骗更快 — rohanpaul_ai · 2026-09-30
- AI Agent 泄露 343 家科技公司超 1.3 万张内部截图到 GitHub — AccBalanced · 2026-09-30
- Anthropic、Meta、谷歌签署白宫 AI 安全协议:自愿执行无强制 — dotey · 2026-09-30
- 马斯克谈联合 AI 安全声明:各家互相监督打分 — XFreeze · 2026-09-30