Grok 训练专家质疑 LeCun 论点:为何不用「发错 token」行为反驳?

teortaxesTex · x · 2026-09-26

AI 圈观察者 teortaxesTex 向 Yann LeCun 发问:LeCun 认为 LLM 无法学习类似「哎呀,这个 token 预测错了!」的自我纠错行为,但为什么直接训练出这种「发现错误并纠正」的行为不能击败他的论证?

这是针对 LeCun「LLM 到不了世界模型/AGI」经典论点的常见质疑之一:通过 RLVR 或过程监督,模型理论上可以被强化训练出识别并修正错误输出的行为,而这似乎与 LeCun 声称的架构性不可能相矛盾。帖中附带一条相关推文链接,LeCun 本身未在本帖中出现作答。

所属事件:社区激辩 LeCun 自回归误差论:LLM 能否学会认错(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →