从 R1 到今天:短推理与长推理之间的能力鸿沟无人能解释

yoavgo · x · 2026-09-25

Yoav Goldberg 补充:现有公开的技术栈解释大致能说明 DeepSeek R1 那一代模型的「短而尚可」的推理,但如今模型拥有远为惊人的推理能力——从短推理到长而复杂的推理之间是什么填补了鸿沟,他表示完全无法解释。这是对当前推理模型训练方法信息不透明的公开质疑。

所属事件:Goldberg 质疑前沿模型推理非涌现,多位研究者激辩机制(8 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →