LLM输入防火墙:用正则与Luhn算法拦截PII与注入

GiiTZzz · reddit · 2026-08-09

作者分享了其自建的 LLM 防火墙方案,通过在应用与模型之间部署代理层,利用正则表达式匹配 SSN 和邮箱格式,结合 Luhn 算法验证信用卡号,并维护已知提示词注入短语列表,从而在请求发往模型提供商前进行拦截。

文章重点探讨了误报与漏报之间的权衡难题:规则过严会拦截正常对话,过松则无法防范真实泄露。作者公开了在线测试版本,并向社区征集在生产环境中检测输入输出、选择正则还是分类器等方面的实战经验。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →