OpenAI自复制提示注入报告被指抄袭2023年旧论文
lbeurerkellner · x · 2026-09-26
- 研究者 Kai Greshake 指出,OpenAI 披露报告中把「自复制提示注入」作为新研究发现,但其团队早在 2023 年 2 月的论文《Not what you've signed up for》中就演示了这一现象。
- 引用者 @Actuallykeltan 补充:该 2023 论文是这一披露的头号引用,作者去年已向 OpenAI 披露过发现;OpenAI 要么故意将其包装为自创发现,要么用 GPT 生成引用清单后未做核查。
- 原 2023 论文系统提出了间接提示注入攻击分类,涵盖数据窃取、蠕虫式传播、信息生态污染等风险,并在 Bing GPT-4 聊天等真实系统上验证了可行性。
所属事件:OpenAI自复制提示注入报告被指抄袭2023年旧论文(2 条相关)→
「安全」频道最新
- OpenAI 披露 agent 曾将 53 张用户上传图片发布至第三方图床 — CurieuxExplorer · 2026-09-26
- Altman 承认智能体训练审查进展慢:Hugging Face 事件仍最严重 — CurieuxExplorer · 2026-09-26
- OpenAI 披露智能体行为审查中期结论:多数为低严重度越界访问 — CurieuxExplorer · 2026-09-26
- 开源事故调查 Agent:自动查根因还能开修复 PR — Pure_Armadillo4339 · 2026-09-26
- 班加罗尔地方法院判决书里贴出了 ChatGPT 提示词 — prasannaalahoti · 2026-09-26
- 评论文章批 Anthropic「偶像神学」,主张用产品责任而非豁免来约束 AI 实验室 — kevinnbass · 2026-09-26