新训练配方宣称比标准 scaling 省 5.17 倍数据

inductionheads · x · 2026-07-21

这条转述的是一项关于 LLM 训练配方 的研究:当算力继续增长、数据却越来越紧张时,传统 scaling recipe 可能已经不够省数据。

原文给出的两个关键发现是:

研究者基于 Chinchilla 式 scaling law 进一步推算:如果同时激进地放大单模型规模和集成规模,最终配方在相近效果下可实现 5.17 倍的数据效率提升。配图展示了标准 recipe、正则化 recipe、集成 recipe 以及联合 scaling recipe 的对比,联合策略的数据效率最好。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →