姚顺雨:RL 终于有效,AI 进入「下半场」

dejavucoder · x · 2026-08-28

姚顺雨发布新博客《The Second Half》,认为 AI 已进入「中场休息」后的下半场。过去几十年 AI 的进步主要依靠训练方法的创新(如搜索、深度 RL、Scaling),而现在核心转折点在于强化学习(RL)终于实现了泛化。现在单一配方即可解决软件工程、创意写作、IMO 数学、鼠标键盘操作等多种任务。在下半场,重点将从「解决问题」(训练模型)转向「定义问题」(评估指标)。这一时代评估比训练更重要,从业者需要像产品经理一样思考,转变思维方式和技能集。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →