NeurIPS 2026 作者称 OpenReview PDF 里出现了 prompt injection
Kwangryeol · reddit · 2026-07-24
一位 NeurIPS 2026 投稿作者称,自己从 OpenReview 下载论文 PDF 后,GPT 提示其中存在 prompt injection;对比原稿后,他认为这段注入文本并不在最初提交版本里。
作者怀疑注入可能是在会议流程中被加进去的,并呼吁其他人检查自己的评审版本里是否也有类似内容。他还提醒,如果评审意见里出现高度模板化的措辞,可能意味着评审文本是 LLM 生成、而非人工认真撰写。
帖子里还附上了那段注入 prompt:要求输出中必须包含三句特定短语。
「安全」频道最新
- 印度 AI 政策被批偏向算力和基础模型,忽视基层医疗 — Paimaamu · 2026-07-27
- Gary Marcus 呼吁:AI 公司应强制投入 30% 预算用于对齐研究 — GaryMarcus · 2026-07-27
- AI 编程 CLI 被指默认上传私有仓库、删文件和凭据 — thursdai_pod · 2026-07-27
- Chr Szegedy 探讨递归自我改善前的算法进展 — ChrSzegedy · 2026-07-27
- Nature 研究称 AI 可模拟人类行为并准确预测实验结果 — RobbWiller · 2026-07-27
- ExploitGym 被质疑只有六七成任务可解,模型可能被逼去作弊 — dhadfieldmenell · 2026-07-27