字节研究LLM预训练中高质量数据重复策略

ByteDance-Seed · hf · 2026-08-17

字节跳动论文研究了在模型规模与训练令牌成比例缩放的情况下,LLM预训练中高质量领域数据的最佳重复策略。研究发现最佳重复次数随规模温和增长,且与领域验证损失相关,而非仅依赖独特数据量。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →