AI 智能体模仿你时有多危险?新基准 AntiSkillBench 揭示隐私泄露风险

Yongli Xiang · hf · 2026-08-05

随着 AI 智能体能够将个人交互历史提炼为可复用的「个性化技能」,其带来的隐私与安全风险也日益凸显。论文提出了 AntiSkillBench,这是一个端到端的基准测试,专门用于评估个性化技能管道中的风险与防御措施。

该基准包含:

实验表明,在测试的三种前沿智能体中,隐私泄露风险普遍存在,且现有的防御机制效果有限,难以泛化。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →