开源智能体安全靶场:9 场景攻破 Agent 权限边界

Rewanth_Tammana · reddit · 2026-09-16

安全研究员 Rewanth Tammana 发布开源项目「Who Let the Agents Act?」,一个故意留有漏洞的智能体 AI 实验环境,核心是同一场景的三种实现对比:🔴 过度授权的脆弱版、🟡 只靠提示词约束的版本、🟢 在模型外部强制执行授权与安全控制的加固版。

目前包含 9 个场景:

项目的关键价值在于所有实现代码公开,可检视漏洞代码、加固控制、工具逻辑与执行轨迹,看清信任边界在哪里成功或失败。核心原则:提示词可以影响 agent 行为,但绝不应定义 agent 的权限。作者欢迎社区尝试攻破加固版实现。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →