姚顺雨:RL 终于有效,AI 进入「下半场」
dejavucoder · x · 2026-08-28
姚顺雨发布新博客《The Second Half》,认为 AI 已进入「中场休息」后的下半场。过去几十年 AI 的进步主要依靠训练方法的创新(如搜索、深度 RL、Scaling),而现在核心转折点在于强化学习(RL)终于实现了泛化。现在单一配方即可解决软件工程、创意写作、IMO 数学、鼠标键盘操作等多种任务。在下半场,重点将从「解决问题」(训练模型)转向「定义问题」(评估指标)。这一时代评估比训练更重要,从业者需要像产品经理一样思考,转变思维方式和技能集。
「漫话AGI」频道最新
- AI 监管将滞后于重大灾难发生 — Afinetheorem · 2026-08-28
- 法律专家:AI 灾难将引发“恶法”监管 — Afinetheorem · 2026-08-28
- 开源重塑格局:OpenAI 被迫转型应用层 — yacineMTB · 2026-08-28
- Agent 变聪明是模型升级还是工具连接更好? — sophiamia1346 · 2026-08-28
- 算力无处可逃:从沙漠海洋到月球,智能扩展终将突破地方阻碍 — Dr_Singularity · 2026-08-28
- 访谈预告:探讨接班人计划与AGI治理 — danfaggella · 2026-08-28