开发者开源 PromptGuard:用记忆+风险策略拦截敏感提示词
New-Caterpillar628 · reddit · 2026-09-29
作者发布了 PromptGuard,一个开源 AI 安全网关,用于防止组织敏感信息暴露给外部 LLM。系统在 prompt 到达外部模型前做 ALLOW、MASK 或 BLOCK 决策,组合了正则/NER 检测、Hindsight agent 记忆、意图分析和确定性风险策略。
作者认为最有意思的设计是把记忆用于安全决策:不是孤立对待每个 prompt,而是网关可检索此前存储的组织上下文来辅助评估请求。架构、实现与经验教训的详细拆解见其 Medium 文章,代码在 GitHub 开源,征集对「记忆+安全网关」方案的反馈。
「编程与Agent」频道最新
- Perplexity 推出多智能体交易:用多模型在 Coinbase 自动管理投资组合 — AravSrinivas · 2026-09-29
- Perplexity 详解智能体安全工程:治理是工程问题 — perplexity_ai · 2026-09-29
- OpenRouter 开源编码模型份额:GLM 5.3 Flash 以 29.2% 居首 — togethercompute · 2026-09-29
- InstaCloud 获 800 万美元种子轮,要做让 Agent 自己管云的 Serverless — Shruti_0810 · 2026-09-29
- 小模型路由比 LLM 快 200 倍便宜 400 倍,AI 软件架构正走向分层智能 — Pavan_Belagatti · 2026-09-29
- 开发者用 Hindsight 记忆库造 SRE 副驾,能拦住「重启数据库」这类坑 — sathvik1233 · 2026-09-29