arXiv 论文泼冷水:Lean 验证通过不等于 AI 数学证明正确
asusarla · x · 2026-10-08
Bastounis、Circelli、Hansen 三位作者的 arXiv 论文(2610.08144)直接质疑 OpenAI 宣称的 Navier-Stokes 方程解爆破证明的验证方式:
- 核心论点:autoformalisation(AI 把自然语言数学文本翻译成 Lean 等形式语言再机械验证)无法为原始自然语言论证提供可信保证,因为语义忠实的翻译本身极难
- 理论结果:解决数学自然语言中的歧义问题位于 Solvability Complexity Index(SCI)层级的最顶端(SCI = ∞),形式上比停机问题等任何可计算问题都难
- 实证证据:作者给出多个 AI 在实践中把自然语言陈述与证明误译进 Lean 的例子,导致形式证明与原文不匹配
该文被 @asusarla 转给 Gary Marcus,附调侃「Terence Tao 在 shitposting」。对「Lean 验证 = 证明正确」这一叙事是实质性反证。
所属事件:剑桥论文质疑 Lean 验证可信度,直指 OpenAI Navier-Stokes 证明(14 条相关)→
「安全」频道最新
- 法国拟设立 AI 专属行政监管机构,与 DINUM 等多机构并行 — julsimon · 2026-10-09
- GPT-6 Sol 信任访问版登顶 Cyber Index,单任务成本仅 Grok 的 1/6 — ArtificialAnlys · 2026-10-09
- 密码学家再补刀:真正担心的不是所有公钥加密,而是标准化方案的单一依赖 — matthew_d_green · 2026-10-09
- 密码学家回应加密破产传闻:前沿实验室提问方向泄露蛛丝马迹 — matthew_d_green · 2026-10-09
- 传 OpenAI 因越权与汇报失实担忧推迟 GPT-6.1 Astra 十月发布 — johnkwaters · 2026-10-09
- Nathan Lambert 登台:开放科学仍能解决 AI 安全与扩散难题 — natolambert · 2026-10-09