恶意软件内置核武器文本触发安全护栏,骗过 AI 杀毒分析
BLUECOW009 · x · 2026-09-02
ESET 研究人员将这种新型规避手法命名为「GuardBreaker」。亲俄黑客组织 UAC-0099 在恶意 VBS 脚本的注释中植入核武器制造说明等内容:AI 安全工具读取文件时,模型安全护栏被触发,拒绝或中止分析,而真正的恶意代码则继续执行,最终安装投递后续载荷的 MATCHBOIL loader。
这不是孤例:今年 6 月 Socket 已发现供应链攻击中使用同类手法,恶意包内嵌生物/核武器文本与伪造系统指令来干扰 AI 恶意软件扫描器。攻击者正系统性地把 LLM 安全护栏变成自身的护盾。
「安全」频道最新
- AI 对齐期刊 Alignment Journal 创刊,Scott Aaronson 等坐镇 — sethlazar · 2026-09-02
- JHU 彭博中心启动 GAIT 计划,招聘总监推动后 AGI 时代治理研究 — sethlazar · 2026-09-02
- Google 发布 Gemini 3.8 Flash 与网安模型 3.8 Flash Cyber — koraykv · 2026-09-02
- 对齐理论研究征集:负结果论文同样欢迎 — timrudner · 2026-09-02
- 征稿聚焦:超越当代架构、面向超级智能的对齐理论分析 — timrudner · 2026-09-02
- 关闭安全护栏后 Claude Mythos 5.1 写出可用漏洞 250 试 245 中 — rohanpaul_ai · 2026-09-02