RLVR 时代别再用「人数据训练」理解 AI:纳维-斯托克斯解不在语料里
burny_tech · x · 2026-09-23
一位网友反驳「AI 只是 trained on human data」的流行认知:预训练确实用人类数据,但当前模型更关键的是 RLVR(可验证奖励的强化学习)训练,这部分能力显然不来自互联网语料——纳维-斯托克斯等千禧年难题的解法不可能在网上找到。
作者提醒:如果仍把模型理解为「复述已写下内容的东西」,会错过其最重要的能力。被引用的另一位网友则唱反调,认为预训练数据里没有比人类更聪明的东西,模型逼近人类智能后会陷入停滞——这一争论本身也是 AI 训练范式的核心分歧点。
「漫话AGI」频道最新
- OpenAI 垂直化难成功:行业默认格局与社会切换成本是壁垒 — nicolechirps · 2026-09-23
- 「5 万个 AI agent 可绕过任何材料学瓶颈」引热议 — teortaxesTex · 2026-09-23
- Mark Cuban:医疗福利成本比 AI 更先让更多人失业 — alvelda · 2026-09-23
- 150 万人诞生于原子弹之前:为何历史经验难预测 AI 风险 — AndyMasley · 2026-09-23
- 网友提 AGI 判据:半年白领任务可替代之外,还须长期可靠 — ChrisGPT · 2026-09-23
- Dustin Moskovitz:EA 生态最大金主,数十亿美金投向 AI 安全 — SydSteyerhart · 2026-09-23