预训练数据重复浪费算力?ICML论文揭示大模型更耐重复

heghbalz · x · 2026-08-22

这篇论文探讨了在大模型预训练中,当高质量领域数据稀缺时,通过重复数据来维持固定 TPP(tokens-per-parameter)的策略。研究发现:

这为解决高质量数据稀释问题提供了新的工程视角。

所属事件:ICML新研究:模型越大越耐预训练数据重复(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →