研究者将在 Intel AI 安全夜发布智能体分解攻击基准

研究员 Chhavi Yadav 宣布将在 Intel AIM 组织的 AI Safety Night 活动上发表演讲,介绍其针对 AI 智能体的"分解攻击"最新研究。该工作构建了一个分解攻击基准,用于系统性测试 AI Agent 系统的安全性。作者同时公开了论文、Benchmark 链接及演讲幻灯片等相关成果。

2026-08-19 ~ 2026-08-19 · 4 条相关