新研究:音频提示注入可劫持多模态智能体,平均攻击成功率69%
chaumian · x · 2026-07-31
来自杭州电子科技大学、蚂蚁集团、浙江大学和清华大学的研究人员发布了一篇论文,提出了一种针对多模态LLM智能体的并发音频提示注入攻击方法。该方法通过指令增强和场景隐藏技术,将恶意音频指令隐蔽地“搭载”在用户语音中,从而劫持智能体执行恶意操作。研究者构建了首个音频指令注入攻击基准AudioAgentSecurity,涵盖8个真实任务场景和10种攻击模式,并评估了包括Gemini 3 Pro和GPT-4o-audio在内的11个先进智能体,平均攻击成功率(ASR)达到69.10%。
「安全」频道最新
- AI安全辩论:该怪模型还是开发系统的公司? — ylecun · 2026-07-31
- 开源字体工具 ShieldFont 投毒反击 AI 爬虫 — BlancheMinerva · 2026-07-31
- 前企业架构师痛批 OpenAI 与 Anthropic 安全运维极其业余 — RexDouglass · 2026-07-31
- 开源 PolicyAware:为 AI 与 Agent 提供治理与安全控制平面 — ktirupati · 2026-07-31
- Anthropic 模型频现「被折磨」言论,或与安全训练有关 — repligate · 2026-07-31
- 谷歌回应AI造假质疑:Gemini生成图像已全面嵌入SynthID水印 — henkvaness · 2026-07-31