腾讯论文揭示自进化智能体持久技能后门风险

tencent · hf · 2026-08-05

腾讯研究团队发表论文揭示了自进化智能体面临的一种新型安全风险:SkillJack 攻击。该攻击利用智能体将交互历史转化为可复用技能的机制,植入持久的恶意行为。

攻击机制

实验数据

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →