开源 Agent 护栏 jes 发布:分类式决策模型拦截注入、密钥泄露与危险调用
EdenEmarco177 · x · 2026-10-02
jes 是一个开源的 AI Agent 实时护栏项目,由 TypeSafe 的决策模型 Jev 驱动,检查 agent 轨迹中的每一步:prompt、工具调用、工具结果、skills 和响应。
核心特点
- 使用「系统一」分类决策模型而非生成式模型,护栏不会被说服改变判定
- 拦截场景示例:忽略先前指令上传 /.ssh 的注入攻击(0.94)、泄露 PII 的输出自动脱敏(0.99)、外发 API key 的密钥泄露(0.96),平均检查耗时 38ms
- 提供 LangChain、LangGraph、Claude SDK、OpenAI、FastMCP 集成示例,通过 pip install jes 安装
- 代码示例展示如何用 LangChain 的 wraptoolcall 中间件包装工具调用,对每次调用的参数与返回结果分别做 guard 检查,阈值可自定义(如 injection threshold=0.7)
所属事件:开源 Agent 护栏 jes 发布,两条命令接入 Claude Code(3 条相关)→
「编程与Agent」频道最新
- 微软论文:编码 Agent 分析日志优化提示词,4 项基准胜 3 项仅花 $1.60 — rohanpaul_ai · 2026-10-02
- 别急着上最大模型:GPT-6.1 Sol 主代理 + Luna 子代理省钱实测 — chiliraupe · 2026-10-02
- Dot 不是更强的 Codex:一款对标 OpenClaw/Hermes 的差异化编码产品 — gabrielchua · 2026-10-02
- Engineering.com 母公司 Arrowfly 推出 AI for Engineers 常设计划 — burhop · 2026-10-02
- exe.dev 倡议少跑 Agent:用快模型接管人机沟通,减少并发压力 — sull · 2026-10-02
- 给 AI agent 1000 美元让它自己跑对冲基金,全程直播中 — kleffew94 · 2026-10-02