NULLs 摘 COLM 隐私安全研讨会最佳论文:实现完美机器遗忘
pratyushmaini · x · 2026-10-10
Pratyush Maini 与 Gaurav Ghosal 等人的 NULLs 项目获得 COLM 隐私与安全研讨会最佳论文奖。
- 目标是「完美遗忘」(perfect unlearning):让模型的表现与删掉目标数据后从头重训的模型完全一致,作者坦言起初并不确定能做到。
- 核心是一个巧妙的概念性训练方法,可自然扩展;工程实现由 Ghosal 几乎独立完成,并推广到了大语言模型规模。
- 团队希望 NULLs 未来成为语言模型训练的默认选项,让训练数据更可控,并为构建更安全的模型提供新路径。
所属事件:NULLs 论文获 COLM 隐私安全研讨会最佳论文(2 条相关)→
「安全」频道最新
- VirusTotal 警告:增长最快的 AI Agent 生态 OpenClaw 成恶意软件新通道 — Bedrovelsen · 2026-10-10
- OpenAI 披露安全案例机制:无安全简报则前沿工作一律不许启动 — aidan_mclau · 2026-10-10
- Anthropic AI 智能体在美国国务院网站误提交 20 份签证申请 — Simon Willison · 2026-10-10
- 「用 AI 复活喜剧演员读完整本书」:你会给 AI 生成划个人红线吗 — TheLastKyuna · 2026-10-10
- 记者爆料:某 AI 系统向警方悬案热线提交了完全捏造的举报 — zacharynado · 2026-10-10
- 研究员披露 Lime 漏洞后反遭 Bugcrowd 封号 — rez0__ · 2026-10-10