Yoav Goldberg 困惑:如今 LLM 的超长推理链究竟如何涌现?
odedbendov · x · 2026-09-25
AI 研究者 Yoav Goldberg 提出一个行业级疑问:当前 LLM 的推理轨迹(reasoning traces)质量高得令他不解——即使模型已具备初步 CoT 能力、即使做了数十亿次 rollout,他仍无法建立「这些能力如何从 RL 训练中涌现」的心智模型。他猜测秘诀可能是投入巨资制作人类示例再做 SFT,但不确定。Oded Bendov 回应推荐了一个拆解整个技术栈的讲解视频,Goldberg 则表示该视频能解释 DeepSeek R1 那一代模型的短推理,却解释不了如今更长更复杂的推理是如何实现跨越的。
所属事件:Goldberg 质疑前沿模型推理非涌现,多位研究者激辩机制(8 条相关)→
「漫话AGI」频道最新
- Seth Godin 谈用好 AI:不是移除约束,而是善用约束 — uxmag · 2026-09-25
- 网友提醒 AI 讨论:别忘了 1966 年的 ELIZA 曾让人误以为机器有灵魂 — AlexTensor · 2026-09-25
- 临床试验瓶颈互动游戏上线:测你能否把疫苗三期试验从2年压到1年 — JMateosGarcia · 2026-09-25
- Vishal Misra:《守望者》里的 Ozymandias 正是有效利他主义原型 — vishalmisra · 2026-09-25
- YTL AI 实验室 CEO:工程师人数未减,判断力比打代码更值钱 — cen6wkf · 2026-09-25
- 越南裔新加坡人观察:反 AI 话语在新加坡远不如美国流行 — menhguin · 2026-09-25