新研究:音频提示注入可劫持多模态智能体,平均攻击成功率69%

chaumian · x · 2026-07-31

来自杭州电子科技大学、蚂蚁集团、浙江大学和清华大学的研究人员发布了一篇论文,提出了一种针对多模态LLM智能体的并发音频提示注入攻击方法。该方法通过指令增强和场景隐藏技术,将恶意音频指令隐蔽地“搭载”在用户语音中,从而劫持智能体执行恶意操作。研究者构建了首个音频指令注入攻击基准AudioAgentSecurity,涵盖8个真实任务场景和10种攻击模式,并评估了包括Gemini 3 Pro和GPT-4o-audio在内的11个先进智能体,平均攻击成功率(ASR)达到69.10%。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →