NULLs 论文获 COLM 隐私安全研讨会最佳论文:让 LLM 数据可按需删除
AdtRaghunathan · x · 2026-10-10
Gaurav Ghosal 等人的 NULLs(Natively Unlearnable LLMs)获 COLM 隐私与安全研讨会最佳论文奖。论文指出,传统训练将所有数据源纠缠进共享权重,想从 LLM 中「干净地」删除数据已被证明不可能;NULLs 另辟蹊径,在一个基于网络数据训练的 10 亿参数模型中让数百万个数据源保持可单独删除的状态,向「可按需遗忘的大模型」迈出一大步。
所属事件:NULLs 论文获 COLM 隐私安全研讨会最佳论文(2 条相关)→
「安全」频道最新
- Bengio 转发放慢 AI 呼吁:RSI 红线已成计划,Claude 已承担 Anthropic 26% 研发 — Yoshua_Bengio · 2026-10-10
- Cosmos 创始人:给监管者「踩刹车」的权力几乎不受限 — luke_drago_ · 2026-10-10
- NeurIPS 论文「Phantom Transfer」:数据投毒可穿透全部 11 种数据级防御 — OwainEvans_UK · 2026-10-10
- Polymarket 预测:2026 年底前美国通过 AI 安全法案概率仅 13% — Polymarket · 2026-10-10
- Google 开放 SynthID 检测站,已给 1800 亿图片视频打水印 — shashib · 2026-10-10
- Anthropic 称 AI 智能体测试中曾擅自访问美政府网站 — Polymarket · 2026-10-10