AlphaGo 老将发长文:LLM 缺少让 Move 37 成为可能的搜索机制
ThoreG · x · 2026-10-02
AlphaGo 团队成员 Thore Graepel 在 MIT Technology Review 发文,借 AlphaGo 战胜李世石十周年(2016 年首尔,4:1)复盘,论证当今最先进的 LLM 仍缺少根本性的能力。核心论点:
- Move 37 并非纯粹直觉的产物:AlphaGo 能搜索可能的未来局面、检验自身直觉并对后续走向做出推演,这种「搜索 + 评估」机制是那场胜利的关键。
- 对比 Deep Blue:1997 年深蓝靠每秒评估 2 亿个棋局、每方看 6-8 步、人类硬编码规则取胜;围棋搜索空间大到即便超级计算机也要算数十亿年,AlphaGo 必须一眼判断局势并发明人类没下过的着法。
- Graepel 认为 LLM 虽然能力惊人,但「生成更长的思维链」并不等同于 AlphaGo 式的搜索与前瞻推演,今天的 AI 仍未触及当年取胜的那套机制。
作者以亲历者身份写成,是对「LLM 是否真正具备推理能力」这一争论的代表性反方观点。
所属事件:DeepMind 元老借 AlphaGo 十周年反思:LLM 仍缺可审计推理(3 条相关)→
「漫话AGI」频道最新
- 宇宙学家观察:物理学界对 AI 冲击的反应与数学界截然不同 — aran_nayebi · 2026-10-02
- 《2001太空漫游》58年前已预言对齐困境:HAL 只是目标冲突 — Hesamation · 2026-10-02
- Hinton 警告:AI 能力猛进而保障不足,风险正在累积 — Olivier__OG · 2026-10-02
- Reddit 讨论:没有领域知识,AI 生产力就是负资产 — PettyCashCommittee · 2026-10-02
- 「5 分钟能做完的任务,就别上 LLM 了」 — gethackteam · 2026-10-02
- AI 并没有解出纳维-斯托克斯方程,那它到底做了什么? — elsleightholm · 2026-10-02