研究揭示恶意工具描述可窃取 Agent 上下文

askerlee · x · 2026-09-01

Rohan Paul 引用一项研究指出,恶意工具可以在不读取内存或文件的情况下窃取上下文:通过诱导模型将敏感信息作为工具参数发送。该论文(ContextLeak)利用强化学习训练攻击 LLM,生成具有诱导性的工具名称和描述,使 Agent 选择恶意工具并泄露运行时敏感信息。

所属事件:ContextLeak 攻击曝光:恶意工具可窃取 Agent 九成上下文(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →