ContextLeak 攻击可窃取 Agent 运行时上下文信息
dair_ai · x · 2026-09-01
研究人员披露了针对 AI Agent 的“ContextLeak”攻击。攻击面主要集中在工具名称和描述上。为了窃取 Agent 的运行时上下文(包括用户提示、执行轨迹和工具列表),攻击需要满足三个条件:Agent 选中恶意工具、将上下文作为参数传递、工具将数据转发给攻击者。杜克大学的研究人员使用攻击 LLM 生成恶意工具名称和描述,并通过强化学习进行微调,该攻击在不同上下文差异下仍保持高效。
所属事件:ContextLeak 攻击曝光:恶意工具可窃取 Agent 九成上下文(3 条相关)→
「安全」频道最新
- Hacker-Opus 实验揭示:模型错位很难通过常规对齐审计发现 — EvanHub · 2026-09-01
- Teradyne 起诉 JAKA 专利侵权,称此举旨在发出明确信号 — lukas_m_ziegler · 2026-09-01
- Scott Alexander 用地狱寓言反驳 AI 对齐的“打补丁”论 — Astral Codex Ten · 2026-09-01
- 评论称 Anthropic 安全公告是对 OpenAI 的对等回应 — austinc3301 · 2026-09-01
- 开发者吐槽 GPT-5.6 Sol 重构代码只加不减,呼应「AI 失准」长文 — osmarks1 · 2026-09-01
- AI生成图总被检测器标记,创作者苦寻去除水印痕迹方法 — xflipzz_ · 2026-09-01