Air Street 创始人:AI 实验室正把算力从预训练转向强化学习
nathanbenaich · x · 2026-10-09
Air Street Capital 创始人 Nathan Benaich 解读 AI 实验室的算力转向:
- 过去 4-5 年,业界主要在摸索预训练的「配方」——最优数据配比、最佳成分组合
- 如今预训练方法论已趋于成熟,探索性工作的边际价值下降,减少投入是自然结果
- RL 的核心论点:现有方案只是靠人类智慧与知识共享发现的局部最优,未必是全局最优——所以值得用 RL 去寻找更高的峰值
他简言之就是「scale the RL」:下一阶段的算力将更多投入强化学习。
「漫话AGI」频道最新
- 开发者手写 200 行 Go 代码:久违地感到大脑在运转 — haydendevs · 2026-10-09
- 用真随机解反事实难题:量子随机数发生器可给 RL 提供探索 — jessi_cata · 2026-10-09
- 数学家访谈:AI 数学成果对数学职业意味着什么 — shiringhaffary · 2026-10-09
- OpenAI 定理发布撞车学者在研工作,结果更强但难以读懂 — guyvdb · 2026-10-09
- AI 生成的论文泛滥预印本平台,学者提议用决策语言模型过滤噪音 — lpachter · 2026-10-09
- 把用户耗在应用里别太明显,否则他们会醒悟离开 — moultano · 2026-10-09