针对智能体的分解攻击基准 Decomposition Attacks

chhaviyadav_ · x · 2026-08-19

作者分享了关于“智能体分解攻击”基准构建的最新工作成果,包含论文、Benchmark 链接及演讲幻灯片。该研究在 Intel 组织的 AI Safety Night 上发布,旨在通过分解攻击手段评估 AI 智能体的安全性与鲁棒性。

所属事件:研究者将在 Intel AI 安全夜发布智能体分解攻击基准(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →