RLVR 时代别再用「人数据训练」理解 AI:纳维-斯托克斯解不在语料里

burny_tech · x · 2026-09-23

一位网友反驳「AI 只是 trained on human data」的流行认知:预训练确实用人类数据,但当前模型更关键的是 RLVR(可验证奖励的强化学习)训练,这部分能力显然不来自互联网语料——纳维-斯托克斯等千禧年难题的解法不可能在网上找到。

作者提醒:如果仍把模型理解为「复述已写下内容的东西」,会错过其最重要的能力。被引用的另一位网友则唱反调,认为预训练数据里没有比人类更聪明的东西,模型逼近人类智能后会陷入停滞——这一争论本身也是 AI 训练范式的核心分歧点。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →