Dwarkesh 实验:预训练进步 3/4 来自数据而非架构改进

eliebakouch · x · 2026-09-09

Dwarkesh Patel 与合作者用 2019–2025 各年度代表性的开源模型配方和数据语料,在多个小规模上做预训练组合实验,得出结论:

这一实证结果挑战了「架构创新是主引擎」的叙事,暗示数据工程仍是预训练最大的提升空间。

所属事件:Dwarkesh 实验显示预训练进步四分之三来自数据(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →