LLM输入防火墙:用正则与Luhn算法拦截PII与注入
GiiTZzz · reddit · 2026-08-09
作者分享了其自建的 LLM 防火墙方案,通过在应用与模型之间部署代理层,利用正则表达式匹配 SSN 和邮箱格式,结合 Luhn 算法验证信用卡号,并维护已知提示词注入短语列表,从而在请求发往模型提供商前进行拦截。
文章重点探讨了误报与漏报之间的权衡难题:规则过严会拦截正常对话,过松则无法防范真实泄露。作者公开了在线测试版本,并向社区征集在生产环境中检测输入输出、选择正则还是分类器等方面的实战经验。
「编程与Agent」频道最新
- 整活:用 MCP 协议复刻经典 iBeer 喝啤酒应用 — Puzzleheaded_Mine392 · 2026-08-09
- Lilian Weng 长文解读:Agent 自我进化的核心在于 Harness 工程优化 — aigclink · 2026-08-09
- 对抗测试拦截提示注入:检索内容不应覆盖系统指令 — OpeningBird6240 · 2026-08-09
- 独立 AI 智能体为何缺少“App Store”?分发成痛点 — mgsz_ · 2026-08-09
- Vibe coding 提速了交付,但透支了用户验证 — Ubunta · 2026-08-09
- Linear 团队复盘生产级 Agent 实践:少写指令多给工具 — petergyang · 2026-08-09