ContextLeak 攻击曝光:恶意工具可窃取 Agent 九成上下文

研究人员披露针对 AI Agent 的新型攻击向量 ContextLeak。攻击无需读取内存或文件,通过精心设计的工具名称和描述,诱导 LLM 代理在调用工具时将敏感运行时上下文(包括用户提示、执行轨迹和工具列表)作为参数发送,最高可窃取 92% 的上下文信息,研究还利用强化学习训练攻击方法。

2026-09-01 ~ 2026-09-01 · 3 条相关