开源 AI Agent 运行时安全层:让 Agent 永远拿不到凭证
Technical-Spread-368 · reddit · 2026-10-01
Reddit 用户发布开源项目 Pryxor,一个位于 AI Agent 与其可操作目标系统之间的运行时安全层。Agent 不再直接调用工具,而是把工具调用发给 Pryxor,由它完成:用 API key 认证 Agent、按工具 JSON schema 校验参数、用确定性策略评估调用、返回 APPROVED/HOLD/BLOCKED,若通过则由 Pryxor 自己持凭证执行,Agent 全程看不到凭证。作者最看重 HOLD:调用可能合法但需人工裁决,动作挂起等人确认。
动机是常见反模式——给 Agent 一个宽权限 token 然后指望模型用对;但 prompt injection 和幻觉是概率系统的正常行为,当模型成为安全边界,每次失败都是事故。替代思路是:不给 Agent 凭证,只给它意图,由确定性层决定意图是否变成动作。
作者坦承局限:不是 LLM 防火墙,不扫 prompt/输出;不检测 prompt injection,只限制后果;无法保护绕过它的路径;单节点、SQLite、无多租户/RBAC/SSO;TLS 需自行放在反向代理后。Apache 2.0 开源,附 quickstart 与可克隆的沙箱 demo,作者在评论区收集反馈。
「编程与Agent」频道最新
- 睡前给 agent 布置任务,一觉醒来完成 6.5 小时的工作量 — therealdanvega · 2026-10-01
- 前 OpenAI 研究员推出 System One 模型 Jev,结构化决策快百倍 — KhuyenTran16 · 2026-10-01
- Jev 与 PydanticAI 的关键区别:在模型回答前就锁定决策 — KhuyenTran16 · 2026-10-01
- 博主开发海外播客转写 MCP,把播客变成高质量信息源 — vista8 · 2026-10-01
- Abridge 把临床医生反馈变成可量化评测体系,加速 agent 迭代 — LangChain · 2026-10-01
- 开发者的硬观点:不能阻止合并的 eval,只是装饰品 — bgoncalves · 2026-10-01