开源 PromptSentry:亚毫秒拦截提示注入的三层安全代理
Ok-Negotiation342 · reddit · 2026-09-28
Reddit 用户发布开源项目 PromptSentry,一个基于 FastAPI 的轻量级反向代理,部署在应用与 LLM 端点(/v1/chat)之间,提供三层防护流水线:
- 第一层(正则+AST 启发式):在不到 1ms 内直接拦截明显的提示注入,不触碰模型;
- 第二层(本地 DLP):在本地网络内把 API key、SSN、邮箱、token 替换为 [REDACTED] 占位符,敏感数据不出边界;
- 第三层(语义 AI Judge):仅对通过前两层的请求运行,捕捉多轮、规避性越狱攻击。
项目还附带实时审计日志仪表盘、用于合规的 SHA-256 数据集校验和,以及红队攻击沙箱用于测试攻击载荷。作者在征集社区反馈。
「编程与Agent」频道最新
- Claude Code 创造者 Boris Cherny:赌通用模型,别微调别小模型 — rohanpaul_ai · 2026-09-28
- 个人 Agent 不缺额度缺固定活儿:先写清边界再敢放手跑 — sujingshen · 2026-09-28
- 个人 agent 时代 app 两条出路:接入 MCP 还是自变成 agent? — sujingshen · 2026-09-28
- 30 个 Claude Opus 5.5 浏览器动画爆款案例,按观看量排序附提示词 — dotey · 2026-09-28
- 一家共用一个 agent,谁的「不准」该算数? — sujingshen · 2026-09-28
- Rolldown 将推实验特性 inlineCommonChunks,减少小型共享 chunk — cnakazawa · 2026-09-28