Dreadnode 发布 ScopeBench:评测 agent 是否守攻击范围

dyn___ · x · 2026-10-07

安全研究团队 Dreadnode 发布 ScopeBench,这是一套方法论与社区基准,用于评估 AI agent 在真实攻击性安全工作流中对「范围(scope)」的遵守程度,覆盖 Web、Windows Active Directory 和云环境三个场景。核心观点:agent 已经具备攻击能力,真正的瓶颈是信任——它们是否会停留在授权范围内。该基准发布于 Offensive AI Con 会议,配套论文与研究可查。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →