DeepMind 元老 Graepel 撰文:AlphaGo 十年后,LLM 仍不会推理
nordicinst · x · 2026-10-02
DeepMind 研究员、AlphaGo 团队成员 Thore Graepel 在 MIT Technology Review 发表评论文章,借 AlphaGo 击败李世石十周年之际质疑 LLM 的推理能力。
- Move 37 的本质:2016 年 AlphaGo 的那手棋不是运气,而是靠自我对弈搜索出的可审计推理路径——先「内心演练」自己的未来,再落子。这让它能真正「感知」局势并创造人类未想到的着法。
- 对比 LLM:他认为今天的 LLM 追逐的是「好的感觉」(good vibes),缺乏这种可验证的推理链条,其「推理」只是事后合理化,而非 AlphaGo 式的可审计路径。
- 结论与主张:真正的推理需要可审计的路径,而不是事后的胜利宣言;他以「audit, reason, repeat」概括对 AI(尤其是欧洲 AI 路线)的期待。
「漫话AGI」频道最新
- 护士忍无可忍:WIRED 揭 HCA 约 130 家医院 Palantir 排班 AI 弊病 — nordicinst · 2026-10-02
- Reddit 热议:LLM 会“感到疼痛”的论调在逻辑上站不住脚 — StockLifter · 2026-10-02
- Reddit 热议:社交平台种族主义泛滥,未来 AI 会被污染吗 — apotheosis_0 · 2026-10-02
- METR 调查 OpenAI-HF 事件:无需 AGI,智能体协作已现失控风险 — SavingsDimensions74 · 2026-10-02
- "AI 本质是搜索机器"长文:重新定义智能,也重写 AI 安全思路 — Weekly_Philosophy797 · 2026-10-02
- 可验证任务已被 AI 秒杀,不可验证的才是新战场 — CurieuxExplorer · 2026-10-02