Gary Marcus 指控 OpenAI 把已被公开的自复制注入攻击当作新发现
GaryMarcus · x · 2026-09-26
Gary Marcus 发帖称 OpenAI 在其安全披露中把一种攻击手法宣称为新研究发现,但该手法此前已为人所知,且 OpenAI 自己报告里引用的文献就提到了它。
引用的 Keltan 指出:搜索「Self Replicating Prompt Injection」第一条就是 2025 年的实验性演示;该论文作者去年已向 OpenAI 披露过发现;这篇论文正是 OpenAI 披露报告的首条引用。他认为 OpenAI 要么故意把已有发现包装成自己的新成果,要么是让 GPT 生成了引用清单却没有核对。
「安全」频道最新
- Skill 供应链风险升温,开源 skill-audit 提供离线预装审计 — masiha97 · 2026-09-26
- 新泽西高尔夫球场照片揪出数据中心 62 台违规燃气发电机 — mkheck · 2026-09-26
- malware 让商用 AI 模型投票决定下一步攻击动作 — TechNadu · 2026-09-26
- 查证 NeurIPS 封禁风波:Pangram 检测器误报数据比传闻更难看 — tughanbulut · 2026-09-26
- David Sacks:监管或令 Anthropic 与 OpenAI 失去 6-12 个月前沿优势 — victor_explore · 2026-09-26
- 分析人士猜测 Meta 或借 WhatsApp 群聊导出功能批量喂 LLM — StewartalsopIII · 2026-09-26