研究圈新共识:架构改动只是提效,RL 算力与环境才是能力主驱动

burny_tech · x · 2026-09-23

burnytech 提出并引用讨论:当前开放研究界的共识正在形成——近期的架构改动大多只是效率优化,真正驱动能力提升的是更好的 RL 环境、更多 RL 算力,以及更好的预训练数据。他补充担忧:不希望这种共识让研究者减少对范式级新架构和新训练算法的探索,避免过深陷入当前架构的局部最优。

所属事件:研究圈共识:RL 算力与环境才是能力主引擎(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →