在 LLM 调用前加 PII 门禁:SSN 在服务端就被 400 拦下
Scholeristical · reddit · 2026-09-09
作者分享了一个小而典型的隐私工程实践:产品会把用户粘贴的文本发给 LLM,评审时被问「用户贴社保号(SSN)进来怎么办」——答案是当时没有任何防护。
做法:
- 服务端用正则匹配常见 SSN 格式,在发起 API 调用前直接返回 400 拒绝;客户端做同样校验,让用户即时得到反馈。
- 刻意只针对 SSN,不做通用 PII 清洗——因为该工具的输入本来就依赖大量个人上下文文本,宽泛拦截会毁掉产品。
- 同周还用平台边缘节点的 IP-country 头做了国家门控,直接拒绝非美国流量,因为产品尚未准备好应对国际数据合规。
核心感悟:「负责任的 AI 功能」很大一部分其实是在决定什么不送上模型,在调用前硬性拦截,胜过事后约束模型对敏感输入的处理。
「编程与Agent」频道最新
- Build World 补充:每个 AI 搭建的 3D 世界可一键发布成分享链接 — RanaHanocka · 2026-09-09
- 一条 prompt 生成异星集市:Astra+Thrixel 在 Three.js 里搭出可玩世界 — RanaHanocka · 2026-09-09
- Eval 是需求文档不是目标清单,AI 功能还需「完成的定义」 — rseroter · 2026-09-09
- 「大重构」宣言:文明级代码审计与重构即将到来 — kovasb · 2026-09-09
- 实时语音Agent嫌Silero VAD太慢,求超低延迟静音检测方案 — Lonligrin · 2026-09-09
- ChatGPT插件频繁静默失联,重授权后仍须新开对话才恢复 — Kaboose31 · 2026-09-09