数据重复致LLM预训练算力浪费可达33%

RylanSchaeffer · x · 2026-07-05

数据重复对LLM预训练有害已被广泛认知。Chudnovsky的论文进一步表明,这种危害取决于模型参数量、重复文档数量与重复次数之间可预测的scaling相互作用;错误的组合会严重浪费算力,最多可达约33%。

所属事件:斯坦福研究:数据重复致LLM预训练算力浪费达33%(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →