Grok 训练专家质疑 LeCun 论点:为何不用「发错 token」行为反驳?
teortaxesTex · x · 2026-09-26
AI 圈观察者 teortaxesTex 向 Yann LeCun 发问:LeCun 认为 LLM 无法学习类似「哎呀,这个 token 预测错了!」的自我纠错行为,但为什么直接训练出这种「发现错误并纠正」的行为不能击败他的论证?
这是针对 LeCun「LLM 到不了世界模型/AGI」经典论点的常见质疑之一:通过 RLVR 或过程监督,模型理论上可以被强化训练出识别并修正错误输出的行为,而这似乎与 LeCun 声称的架构性不可能相矛盾。帖中附带一条相关推文链接,LeCun 本身未在本帖中出现作答。
所属事件:社区激辩 LeCun 自回归误差论:LLM 能否学会认错(4 条相关)→
「模型」频道最新
- 更多用户报告 Codex 无法使用,附错误截图 — hugobowne · 2026-09-26
- Codex 宕机,用户涌向高管喊话求重置额度 — rudrank · 2026-09-26
- 用户吐槽 Anthropic:「修复体验」的新功能反从周额度里扣费 — gerardsans · 2026-09-26
- Codex 现服务中断,网友劝用户出门散步 — TheMoonMidas · 2026-09-26
- OpenAI Codex 大面积宕机,报错误 API Key,状态页却无更新 — minimaxir · 2026-09-26
- Codex CLI 与桌面端集体 401,重新登录无效疑似服务端认证故障 — cantrellsolutions · 2026-09-26