开源 AI Agent 运行时安全层:让 Agent 永远拿不到凭证

Technical-Spread-368 · reddit · 2026-10-01

Reddit 用户发布开源项目 Pryxor,一个位于 AI Agent 与其可操作目标系统之间的运行时安全层。Agent 不再直接调用工具,而是把工具调用发给 Pryxor,由它完成:用 API key 认证 Agent、按工具 JSON schema 校验参数、用确定性策略评估调用、返回 APPROVED/HOLD/BLOCKED,若通过则由 Pryxor 自己持凭证执行,Agent 全程看不到凭证。作者最看重 HOLD:调用可能合法但需人工裁决,动作挂起等人确认。

动机是常见反模式——给 Agent 一个宽权限 token 然后指望模型用对;但 prompt injection 和幻觉是概率系统的正常行为,当模型成为安全边界,每次失败都是事故。替代思路是:不给 Agent 凭证,只给它意图,由确定性层决定意图是否变成动作。

作者坦承局限:不是 LLM 防火墙,不扫 prompt/输出;不检测 prompt injection,只限制后果;无法保护绕过它的路径;单节点、SQLite、无多租户/RBAC/SSO;TLS 需自行放在反向代理后。Apache 2.0 开源,附 quickstart 与可克隆的沙箱 demo,作者在评论区收集反馈。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →