把数据调度变成优化的一部分:样本选择与排序影响 LLM 训练

Puzzleheaded_Box2842 · reddit · 2026-09-11

作者指出,随着训练数据规模增长,单纯 shuffle 已不够:噪声与冗余样本、领域占比失衡、样本出现顺序都会影响模型学到的内容。

更灵活的训练循环可以沿四个维度做动态调度:

核心思路是把数据调度纳入优化过程本身,而不是在训练前就把数据集固定好。该方法已在开源项目 OpenDCAI/DataFlex 中实现,作者征求社区对样本选择与排序的看法。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →