开发者开源 25µs 无 LLM 前置过滤器,提前拦截提示注入式 MCP 工具调用
Fuzzy-Ad9840 · reddit · 2026-09-13
开发者发布 Apache-2.0 开源项目 aletheia-mcp(npm 与 MCP 官方 registry 可得):一个确定性的预执行过滤器,在 MCP 工具调用真正运行前拦截提示注入与越权行为。
设计思路
- 市面多数 MCP 护栏要么在热路径上放一个 LLM 判断每次调用(慢且自身可被注入),要么靠各工具自行实现检查;Aletheia 做成零模型、fail-closed 的前置层。
- 两种模式:独立 guard 工具供手动调用,或作为任意下游 MCP server 的透明代理。
- 基于签名/模式匹配,签名来自跨语料的真实越权事件数据集:破坏性 bash 命令、SQL 注入/变更、文件系统逃逸、凭证与 SSRF 外泄尝试。
- 单次检查约 25µs 开销,附带 155+ 测试。
作者坦承局限:这是模式过滤器不是沙箱,黑名单天然不完备。近日有研究员发现一个真实绕过(显式开放网络后,非管道化的先下载后执行模式绕过了混淆过滤器),作者已验证、修复并发布 GHSA-grqh-xhm8-rj49 公告。
作者同时发起讨论:签名/黑名单方案对比全量 allowlist 或沙箱执行,天花板在哪里?
「编程与Agent」频道最新
- 「再开更多 agent」不算答案:agent 时代人类的空闲焦虑 — flavioAd · 2026-09-13
- 社区将实验性 DeepSeek V4.1 steering 移植进 antirez 的 ds4 CLI — antirez · 2026-09-13
- LangChain 发文教你构建领域专用 Agent Harness:harness 决定 agent 上限 — iamrobotbear · 2026-09-13
- Nex-N2.5 上架 OpenRouter:主打视觉反馈回路的免费 agentic 模型 — anthara_ai · 2026-09-13
- 开发者明日直播演示:用 AI Agent 一站接入多个 MCP 服务 — PurzBeats · 2026-09-13
- terms.txt 论文提案:让网站向 AI agent 标明访问条款与定价 — dair_ai · 2026-09-13