开发者开源 PromptGuard:用记忆+风险策略拦截敏感提示词

New-Caterpillar628 · reddit · 2026-09-29

作者发布了 PromptGuard,一个开源 AI 安全网关,用于防止组织敏感信息暴露给外部 LLM。系统在 prompt 到达外部模型前做 ALLOW、MASK 或 BLOCK 决策,组合了正则/NER 检测、Hindsight agent 记忆、意图分析和确定性风险策略。

作者认为最有意思的设计是把记忆用于安全决策:不是孤立对待每个 prompt,而是网关可检索此前存储的组织上下文来辅助评估请求。架构、实现与经验教训的详细拆解见其 Medium 文章,代码在 GitHub 开源,征集对「记忆+安全网关」方案的反馈。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →