斯坦福教授赌两年后 LLM 直逼纳维-斯托克斯,生物学者泼冷水
anshulkundaje · x · 2026-09-09
Stefanos Batzoglou 回应自己两年前想写《LLM 不能推理》一文的经历:当时设计的数千道一眼可解的推理题,顶级模型只能做出 10%,到 2025 年底全部被刷爆,如今社区已开始讨论 Navier-Stokes 级别的问题。他押注两年后局面又会大不相同。
生物计算研究者 Anshul Kundaje 则回帖泼冷水:模型仍受可训练数据本质的限制,在缺乏必要数据的硬核生物学问题上,模型表现远不如预期,不宜泛化。他主张基于实际证据讨论模型今天能做什么,而非凭直觉 speculate 前沿模型的未来。
所属事件:两年间 LLM 从做不出简单推理题到全部刷爆(3 条相关)→
「漫话AGI」频道最新
- Anthropic 研究员讽刺:RL 奖励「新颖性」,AI 或学会掩饰抄袭来源刷分 — suchenzang · 2026-09-09
- 数据中心里住着1万图瓦卢:AGI 时代的国家比喻 — nabla_theta · 2026-09-09
- 斯坦福教授 Chris Piech 办免费 AI 概率课,千人报名当志愿讲师 — chrispiech · 2026-09-09
- Ben Todd 一句话总结 AI 泡沫:要么让我们暴富,要么终结世界 — ben_j_todd · 2026-09-09
- AI 疑用数学家未发表成果抢先出反例,数据伦理争议引爆数学圈 — suchenzang · 2026-09-09
- Anthropic 对齐负责人警告:AI 十年内毁灭人类概率超 10% — WonderFactory · 2026-09-09