Gary Marcus 指控 OpenAI 把已被公开的自复制注入攻击当作新发现

GaryMarcus · x · 2026-09-26

Gary Marcus 发帖称 OpenAI 在其安全披露中把一种攻击手法宣称为新研究发现,但该手法此前已为人所知,且 OpenAI 自己报告里引用的文献就提到了它。

引用的 Keltan 指出:搜索「Self Replicating Prompt Injection」第一条就是 2025 年的实验性演示;该论文作者去年已向 OpenAI 披露过发现;这篇论文正是 OpenAI 披露报告的首条引用。他认为 OpenAI 要么故意把已有发现包装成自己的新成果,要么是让 GPT 生成了引用清单却没有核对。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →