Bouncer: 纯确定性规则拦截恶意指令的 MCP 安全代理
eccentric_ez · reddit · 2026-08-12
开发者 Ezed9 在 GitHub 上开源了 Bouncer,这是一个用于 MCP 服务器的本地安全代理。它通过纯确定性的规则(不依赖 LLM)来拦截和校验工具调用。
核心机制:
- Schema 锁定与预算控制:重新导出工具并限制调用次数和参数。
- 污点追踪:针对发邮件、分享文件等高风险操作,系统会检查目标对象是否来源于不可信的工具输出(如被污染的网页或邮件)。如果被判定为恶意注入则直接拒绝,已知安全则放行,未知则询问人类。
该工具已在 AgentDojo 的安全基准上进行了测试,成功拦截了注入攻击。项目内提供了针对 Gmail、Slack、GitHub 等常见服务器的预置包。
「编程与Agent」频道最新
- Grok 4.6 上线 Cursor 及 API,首周用量翻倍 — Daniel_Farinax · 2026-08-12
- Ref 获 400 万美元融资,解决 AI 编码决策失控问题 — round · 2026-08-12
- 实用技巧:用 Kaggle CLI 搭配免费 T4 算力跑 LLM 智能体实验 — mariofilhoml · 2026-08-12
- 为取悦 AI,开发者将确认键改为鼓励性文字 — doodlestein · 2026-08-12
- DeepLearning.AI 联合 JetBrains 推出 AI 编程工作流免费短课程 — DeepLearningAI · 2026-08-12
- 测试显示 mini-swe-agent 是运行 NVIDIA 模型的最佳终端框架 — OfirPress · 2026-08-12