新研究:大模型在预训练中更能容忍数据重复

StanfordAILab · x · 2026-08-22

StanfordAILab 转发关于预训练数据重复的研究。研究发现,在固定 token 数和参数量的情况下,更大的模型可以容忍更多的数据重复。此外,更高的模型规模和更短的学习率衰减也有助于提高对重复的容忍度。这表明在高质量数据稀缺时,重复利用高质量数据可能是可行的。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →