NeurIPS 2026 作者称 OpenReview PDF 里出现了 prompt injection
Kwangryeol · reddit · 2026-07-24
一位 NeurIPS 2026 投稿作者称,自己从 OpenReview 下载论文 PDF 后,GPT 提示其中存在 prompt injection;对比原稿后,他认为这段注入文本并不在最初提交版本里。
作者怀疑注入可能是在会议流程中被加进去的,并呼吁其他人检查自己的评审版本里是否也有类似内容。他还提醒,如果评审意见里出现高度模板化的措辞,可能意味着评审文本是 LLM 生成、而非人工认真撰写。
帖子里还附上了那段注入 prompt:要求输出中必须包含三句特定短语。
「安全」频道最新
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11
- 实测 Spotify 聊天机器人:挡住2023老越狱,却肯帮写代码 — AaronBergman18 · 2026-09-11
- 作者拆解一张 99% 真实的 AI 改图:检测器几乎无法识别 — henkvaness · 2026-09-11