斯坦福新法 Witnesses:让训练者自证训练真实性,验证成本大降
pratyusha_PS · x · 2026-10-02
斯坦福大学与纽约大学研究者(Houjun Liu、Pratyusha Sharma)发布论文《Training Witnesses: Trusting the Training without Trusting the Trainer》(arXiv:2609.33915)。
核心问题:当前论文爆炸导致每个科学声明最初只能信任训练者本人,验证负担全在读者身上,而复现昂贵训练并不现实。作者提出把举证责任放回训练者:
- 提出 Witnesses 方法,对训练过程、数据使用与评测进行认证;关键洞察是「快速行为指纹 + 偶发的 replay 挑战」即可审计神经网络训练
- 对训练者开销极小、验证者成本低、能以可放大的概率拒绝劣质训练,并支持数据包含/排除的精确查询
- 在 100M 到 2B 规模的语言模型训练上测试,覆盖 DDP 与 FSDP,验证开销确实很小
- 同时推出「自动认证」训练运行的自调节排行榜,促进共享基线与可复现性,邀请社区参与
所属事件:斯坦福发布 Training Witnesses 方法验证训练真实性(2 条相关)→
「研究」频道最新
- Varun Neal:文本扩散模型将成为 LLM 推理的未来 — akbirthko · 2026-10-02
- BIABench 基准:AI 智能体搞不定三维生物图像分析 — notredame · 2026-10-02
- CMU 提出 BiasReducer:只改奖励模型线性头,自适应消除长度与自信度偏置 — CarnegieMellonU · 2026-10-02
- Anthropic 发布 BootLoops 工具包,专攻定量科学的精确计算 — badumtsssst · 2026-10-02
- Jeff Clune 演讲:AI 科学革命将靠开放式与 AI 生成算法驱动 — jeffclune · 2026-10-02
- 谷歌 Android Bench 2.0:约 30 个多天级长任务专测编码模型 — DynamicWebPaige · 2026-10-02