隐私问题出事才被想起,研究者重提 2022 年差分隐私预训练警示论文
thegautamkamath · x · 2026-09-09
研究者 Gautam Kamath 表示自己不了解近期 NS 相关指控的内情,但指出这类数据隐私问题往往只在「可能出了坏事之后」才被想起。他引用了 2022 年与 Florian Tramèr、Nicholas Carlini 合写的 arXiv 立场论文。
该论文质疑将大规模网络抓取数据上的预训练视为「保护隐私」的做法:公开这种预训练模型可能造成伤害并侵蚀公众对差分隐私的信任;常用 benchmark 未必能衡量预训练模型向敏感领域泛化的能力;且预训练收益主要集中于大到用户无法本地运行、必须把私有数据外包给第三方的模型,今天部署这类模型对隐私可能是净损失。
「安全」频道最新
- 质疑 OpenAI 万 Agent 隔离:连千实例都没管住过 — scaling01 · 2026-09-09
- 斯坦福教授呼吁 OpenAI、Anthropic 立即出法律约束性声明 — mo_lotfollahi · 2026-09-09
- 150 人涌入英国议会,当面质询 AI 政策领域重要人物 — DavidSKrueger · 2026-09-09
- Anthropic 称已实践层面解决提示注入,实测 OpenAI 新模型仅与 Gemini Flash 相当 — Signalman23 · 2026-09-09
- NVIDIA OpenShell 如何保障自主智能体安全 — NVIDIAAI · 2026-09-09
- 思辨:能力 RL 环境中的模型可能学到「能用就用」的最笨启发式 — 1a3orn · 2026-09-09