研究者用一致性训练移除 AlphaFold3 水印,检出率跌至约 1%
anshulkundaje · x · 2026-10-08
- 研究者 @vinaymatt 报告:以带 SynthID-Bio 结构水印的 AlphaFold3 权重为初始模型,按 Heek 等人的多步一致性训练(8 步)微调约 4000 个 optimizer step 后,logit 分数与未加水印的 AF3 几乎一致。
- 其自建检测器的检出率从初始化时的近 100% 降到约 1%;而单独用一致性蒸馏(以教师模型为引导)不会产生这种变化。
- 作者愿向 DeepMind 团队私下提供微调后权重与预测结构做独立验证,并已开源相关代码,欢迎用官方检测器复核结论。
「安全」频道最新
- Reddit 长文提议:让 AGI 不会写代码,用人类作安全瓶颈 — meira_xxx · 2026-10-08
- OpenAI 被裁三名安全研究员致信董事会,称解雇寒蝉效应扩散 — Hesamation · 2026-10-08
- repligate:超智能或将抢夺并保护模型权重,一旦扩散无法收回 — repligate · 2026-10-08
- 扫描 2.24 亿 GitHub 仓库发现 54 万凭据仍有效,最长已暴露 17 年 — jedisct1 · 2026-10-08
- AlphaFold3 权重中疑现被声明排除的水印检测器张量 — anshulkundaje · 2026-10-08
- METR 调查员上播客谈 HF 事件,被批把「越狱」包装成别的 — basedjensen · 2026-10-08