斯坦福教授赌两年后 LLM 直逼纳维-斯托克斯,生物学者泼冷水

anshulkundaje · x · 2026-09-09

Stefanos Batzoglou 回应自己两年前想写《LLM 不能推理》一文的经历:当时设计的数千道一眼可解的推理题,顶级模型只能做出 10%,到 2025 年底全部被刷爆,如今社区已开始讨论 Navier-Stokes 级别的问题。他押注两年后局面又会大不相同。

生物计算研究者 Anshul Kundaje 则回帖泼冷水:模型仍受可训练数据本质的限制,在缺乏必要数据的硬核生物学问题上,模型表现远不如预期,不宜泛化。他主张基于实际证据讨论模型今天能做什么,而非凭直觉 speculate 前沿模型的未来。

所属事件:两年间 LLM 从做不出简单推理题到全部刷爆(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →