版权微调泄露论文遭专家驳斥:记忆度量与实验方法存在严重问题
technollama · x · 2026-09-09
A. Feder Cooper 撰文回应争议论文《Alignment Whack-a-Mole》(Liu et al., 2026)。该论文通过微调前沿模型提取受版权训练书籍内容,进而对版权问题做出强断言。Cooper 在两位记忆研究专家同事把关后认定:论文的核心结论站不住脚——其依赖的记忆度量与提取方法论经不起推敲,「最好情况是严重夸大,最坏情况是大部分结论错误」,且论文细节不足以致无法区分两者。他披露曾于 3 月私下调阅预发布版并提出意见但未获解决,最终基于负责任披露原则公开质疑。Derek Slater 转发并称其在记忆与经验主义部分的分析非常扎实,且作者还批评了另一篇被广泛报道但有缺陷的论文。
「安全」频道最新
- 新论文揭示 Agent 记忆可「洗白」越权权限,误授权率超 50% — BlancheMinerva · 2026-09-09
- 实验室内部人士:用户对话几乎不可能进入训练,Opt-out 后概率为零 — willdepue · 2026-09-09
- IAPS 全额资助 AI 政策奖学金开放申请:三个月最高补贴2.7万美元 — anthara_ai · 2026-09-09
- 调查显示不到 3% 数学论文被标注双用途风险,数学成 AI 风险洼地 — alexbilz · 2026-09-09
- 前 OpenAI 成员质疑:改写后的 ZDR 数据根本没法拿来训练 — willdepue · 2026-09-09
- 前 GDM 研究员 Josh Engels 加入 METR,专注对齐事件调查 — dhadfieldmenell · 2026-09-09