港大讲座探讨 LLM 数学推理:成功为何比看起来更脆弱
YiMaTweets · x · 2026-09-07
香港大学数据科学研究所将举办第 28 期 Scholar Seminar「LLM Math: Prospects and Challenges」,由哲学系副教授 Boris Babic 主讲(2026 年 9 月 25 日,线上线下混合)。
- 核心问题:LLM 是否真正具备数学推理能力,还是其成功比看起来更脆弱
- 论证框架:训练 LLM 擅长形式推理,本质上是要求一个以归纳为主的推理引擎产出演绎有效的结论,这一结构性矛盾导致四类持久缺陷——推理脆弱性、解析不稳定、数值能力差、依赖外部工具
- 讲座将解释为何这些失败可预测且难以根除,并主张建立 LLM 算法性能的「内在主义保证」,探讨直接学习、人工编码、外包等几条路径
- 基于张清鹏发表于 PNAS 的论文(博士后 Fei Jing 为一作)
「漫话AGI」频道最新
- Cloudflare 高管预测:五年内 agent 流量将达人类流量千倍 — 4KTV · 2026-09-07
- 「Astra 是 AGI 因为它会用 Blender」:Reddit 吐槽 AGI 定义通胀 — Possible_Door_9719 · 2026-09-07
- AI 求证 ζ(5)(3) 无理性引争论:数学家如何界定 AI 成果价值 — littmath · 2026-09-07
- paraschopra:AI 应做人类的外骨骼,而非追求完全自主替代 — paraschopra · 2026-09-07
- AI 让「验证式工作」首次可行:易验证的贡献价值最大 — RexDouglass · 2026-09-07
- Toby Walsh 新书 God AI:超级智能或在本世纪内到来 — TobyWalsh · 2026-09-07