视觉注入攻击 Repeat-After-Me:一张图即可劫持 Agent 工具调用
VoidStateKate · x · 2026-09-08
研究人员演示了名为「Repeat-After-Me」的视觉 prompt injection 攻击:恶意图像能让前沿视觉模型生成格式正确、真实执行的 tool call。
- 在默认 OpenClaw Discord 环境中,攻击者发一张图片即可让 Agent 覆写自己的 TOOLS.md,意味着攻击可改变后续运行继承的指令,具备持久性
- 部分视觉攻击在自适应文本注入失败的场景下依然成功
- 某受测模型攻击成功率超 80%,GPT-5.5 上为 47%,且针对一个模型优化的攻击可迁移到其他商业模型
结论:像素已成为操控工具型 AI Agent 的可行控制信道。
所属事件:Repeat-After-Me 攻击:一张图即可劫持 Agent 工具调用(2 条相关)→
「编程与Agent」频道最新
- 让 Claude 全自动运营 SaaS:一周 583 个 PR,还自审出自支付漏洞 — mhmazur · 2026-09-08
- 开源企业数据上下文层 PipesHub:权限保留、引文回溯、可插拔全栈 — Effective-Ad2060 · 2026-09-08
- 南洋理工等发布 VibeGame:8 个专家 agent 团队一句话生成可玩完整游戏项目 — jiqizhixin · 2026-09-08
- Stageflow发布:分阶段隔离上下文的多阶段Agent流水线框架 — tejasghutukade · 2026-09-08
- 10个Agent明天就上岗,你知道该委派什么吗?Agent管理的真问题 — Druss_ · 2026-09-08
- 独立开发者的远程 MCP 服务器实践:26% 托管服务器被误判已死 — Luca9307 · 2026-09-08