DeepSeek:数据质量提升的回报已超新算法创新
DeepSeek 在一份报告中指出,当前后训练的进步更多来自「更好的数据 + 更好的环境」,而非 RL 算法本身的新颖性,提升数据质量的 ROI 已远超继续研究新的 post-training 算法。评论者认为这印证了数据仍是最大的护城河,对以算法创新见长的 DeepSeek 而言是一次明显的转向信号。
2026-09-10 ~ 2026-09-11 · 2 条相关
- DeepSeek 报告:后训练进步靠更好数据与环境,而非 RL 算法创新 — realsohamparekh · 2026-09-10
- DeepSeek 转向:提升数据质量的 ROI 已超过新算法 — A_K_Nain · 2026-09-11