Split-LLM 训练隐私防线失守:零梯度模式泄露真实数据
Setloop · hf · 2026-09-09
Hugging Face 上研究者报告一种 split-LLM(分割式大模型)训练系统的隐私失效案例:系统虽通过了隐私检查,但真实数据行会通过零梯度模式泄露——即使启用梯度裁剪和噪声,攻击者仍能恢复 token。作者描述了「诱饵数据」被返回的零梯度信息抵消的机制,暴露分割训练范式在隐私上被低估的风险。
「安全」频道最新
- OpenAI 图像模型 Images V2.5 遭越狱攻破 — flowersslop · 2026-09-09
- 研究者警告:勿在非本地 LLM 中输入商业机密,提示词或被监测挖掘 — SumitGup · 2026-09-09
- 安全拒绝即全量存档?从业者讽智能体「追责式」历史快照 — suchenzang · 2026-09-09
- Anthropic 以「安全」为由撤销 Fable 5+ 模型全部零数据保留选项 — niloofar_mire · 2026-09-09
- 实测盘点:前沿模型厂商隐私条款里的隐藏陷阱 — niloofar_mire · 2026-09-09
- 不透明「安全分类器」成厂商无限期保留对话数据的借口 — niloofar_mire · 2026-09-09