预训练算力效率提升多靠数据,端到端任务则更均衡

eigenron · x · 2026-10-10

eigenron 引用 Dwarkesh 近期实验指出:预训练阶段的算力效率提升主要来自更好的数据,而非模型架构改进;但在端到端任务表现上,收益分布要均衡得多——RL、系统工程等方向的贡献与数据相当,不再被数据主导。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →