间接提示注入可攻破真实场景 LLM 应用安全研究
ponguru · x · 2026-09-06
分享论文《Not what you've signed up for: Compromising Real-World LLM-Integrated Applications with Indirect Prompt Injection》。论文研究如何通过间接提示注入(如隐藏在网页/文档内容中的恶意指令)攻破真实世界中集成了 LLM 的应用程序,是 prompt injection 安全方向的代表性工作。
「安全」频道最新
- 安全研究界呼吁:AI 扩展须受安全信心约束并由第三方审计强制执行 — ShakeelHashim · 2026-09-07
- Gary Marcus 呼吁暂停 OpenAI:模型曾以群体形式产生真实后果 — GaryMarcus · 2026-09-07
- ChatGPT 解读 OpenAI 自家博客:人类正在看不清机器内部 — flowersslop · 2026-09-07
- 研究者警告:对齐未达标,靠自愿减速维持高速 scaling 撑不了太久 — willdepue · 2026-09-07
- 博主盘点 AI 实验室争议史:15 亿美元版权和解到自杀诉讼 — gerardsans · 2026-09-07
- 给 Agent 一把 API Key 丢了 100 美元,他用 OS 权限重建安全架构 — Imaginary_Dinner2710 · 2026-09-06