Dwarkesh 实验显示预训练进步四分之三来自数据

Dwarkesh Patel 与合作者用 2019-2025 年各年度代表性的开源模型配方和数据语料,在多个小规模上做预训练组合实验,拆解六年来的预训练进步来源。结果显示:数据改进贡献的算力乘数约为模型侧的 3.24 倍,即预训练进步中约四分之三来自数据而非架构等模型改进;具体而言,数据改进带来约 12 倍算力收益,模型改进仅约 3.7 倍。

2026-09-09 ~ 2026-09-09 · 3 条相关