从 R1 到今天:短推理与长推理之间的能力鸿沟无人能解释
yoavgo · x · 2026-09-25
Yoav Goldberg 补充:现有公开的技术栈解释大致能说明 DeepSeek R1 那一代模型的「短而尚可」的推理,但如今模型拥有远为惊人的推理能力——从短推理到长而复杂的推理之间是什么填补了鸿沟,他表示完全无法解释。这是对当前推理模型训练方法信息不透明的公开质疑。
所属事件:Goldberg 质疑前沿模型推理非涌现,多位研究者激辩机制(8 条相关)→
「漫话AGI」频道最新
- Seth Godin 谈用好 AI:不是移除约束,而是善用约束 — uxmag · 2026-09-25
- 网友提醒 AI 讨论:别忘了 1966 年的 ELIZA 曾让人误以为机器有灵魂 — AlexTensor · 2026-09-25
- 机器意识的科学辩论也锚定在大众直觉上 — dioscuri · 2026-09-25
- 临床试验瓶颈互动游戏上线:测你能否把疫苗三期试验从2年压到1年 — JMateosGarcia · 2026-09-25
- Vishal Misra:《守望者》里的 Ozymandias 正是有效利他主义原型 — vishalmisra · 2026-09-25
- YTL AI 实验室 CEO:工程师人数未减,判断力比打代码更值钱 — cen6wkf · 2026-09-25