扩散语言模型曝新攻击面:去噪过程可被定向注入偏见,单卡40分钟搞定

MBZUAI · hf · 2026-10-06

MBZUAI 团队揭示掩码扩散语言模型(dLLM)的一个新控制通道:与自回归模型只在提交答案时暴露分布不同,dLLM 在每个去噪步骤都可修改答案,攻击者可据此闭环干预。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →