针对智能体的分解攻击基准 Decomposition Attacks
chhaviyadav_ · x · 2026-08-19
作者分享了关于“智能体分解攻击”基准构建的最新工作成果,包含论文、Benchmark 链接及演讲幻灯片。该研究在 Intel 组织的 AI Safety Night 上发布,旨在通过分解攻击手段评估 AI 智能体的安全性与鲁棒性。
所属事件:研究者将在 Intel AI 安全夜发布智能体分解攻击基准(4 条相关)→
「安全」频道最新
- AI 趋势观察:多智能体与安全对齐成今年夏季技术热点 — nptacek · 2026-08-19
- AI 风险真相:失控的权限比模型能力更致命 — bigdata · 2026-08-19
- 亚马逊被曝购入稀有书籍扫描后销毁 — PNWHome95 · 2026-08-19
- 2025 年 52% AI 事故为 Deepfake 诈骗 — Comfortable_Gene5180 · 2026-08-19
- 马斯克转发讨论AI寡头垄断与公共利益 — zacharylipton · 2026-08-19
- Zvi 谈水印与约束:非主要降低 x-risk,需测试 — TheZvi · 2026-08-19