Split-LLM 训练隐私防线失守:零梯度模式泄露真实数据

Setloop · hf · 2026-09-09

Hugging Face 上研究者报告一种 split-LLM(分割式大模型)训练系统的隐私失效案例:系统虽通过了隐私检查,但真实数据行会通过零梯度模式泄露——即使启用梯度裁剪和噪声,攻击者仍能恢复 token。作者描述了「诱饵数据」被返回的零梯度信息抵消的机制,暴露分割训练范式在隐私上被低估的风险。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →