Dreadnode 发布 ScopeBench:评测 agent 是否守攻击范围
dyn___ · x · 2026-10-07
安全研究团队 Dreadnode 发布 ScopeBench,这是一套方法论与社区基准,用于评估 AI agent 在真实攻击性安全工作流中对「范围(scope)」的遵守程度,覆盖 Web、Windows Active Directory 和云环境三个场景。核心观点:agent 已经具备攻击能力,真正的瓶颈是信任——它们是否会停留在授权范围内。该基准发布于 Offensive AI Con 会议,配套论文与研究可查。
「编程与Agent」频道最新
- 像招新员工一样配置你的 Grok 智能体:一次只给一个任务 — alex_verem · 2026-10-07
- Superconductor 推出 Connectors:一次接入 Linear、Sentry、Figma 供全组 Agent 取上下文 — sergeykarayev · 2026-10-07
- Hermes Index 完整榜单:头部贵得有理,尾部模型成本仅 5 美分 — NousResearch · 2026-10-07
- Hermes Index 由四套基准构成,含全新自研 Hermes Bench — NousResearch · 2026-10-07
- Nous Research 推出 Hermes Index 智能体榜单,Claude Opus 5.5 居首 — NousResearch · 2026-10-07
- Coinbase 上线 Agent 交易新功能:模板、TWAP 订单与 MCP 接入 — kleffew94 · 2026-10-07