GuardianAgent 论文:让 AI Agent 实时反击网页追踪

flosalim · x · 2026-09-21

一篇 EMNLP 2026 论文提出 GuardianAgent,一个隐私保护框架,可实时根据站点披露策略评估 agent 的出站流量,不只拦截请求,还会自动清洗敏感数据,在风险升高时部署「验证型对抗升级」。

核心方法是策略条件化、风险自适应的匿名化:并非尽量删除敏感信息——过强的匿名化提升隐私但破坏有用内容——而是依据泄露风险决定改写强度,仅当残余泄露被原文实际支撑时才升级重写。

这为「Agent 主动反制侵入式网络追踪」提供了新的技术路线,对 agent 安全与隐私研究者有参考价值。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →