新论文:Lean 验证通过≠自然语言证明正确,AI 数学形式化有根本缺陷

natanielruizg · x · 2026-10-08

剑桥学者 Bastounis、Circelli 与 Hansen 发表论文《Navier-Stokes lost in translation》,直接质疑当前流行的 "autoformalisation" 验证流程——包括 OpenAI 宣称的 Navier-Stokes 方程爆破证明所用的方法。

核心论点:AI 把自然语言数学文本翻译成 Lean 等形式语言后,形式化证明虽可机械验证,但这并不能保证原自然语言论证正确,因为翻译本身可能语义失真。

作者进一步给出理论结果:消解数学自然语言中的歧义(语义忠实翻译的前提)在 Solvability Complexity Index (SCI) 层级中处于任意高位(SCI = ∞),即这一任务比包括停机问题(SCI = 1)在内的任何可计算问题都更难。论文还给出多个 AI 在实践中把自然语言陈述和证明错误翻译进 Lean 的实例,导致自然语言论证与形式化版本不匹配。

所属事件:剑桥论文质疑 Lean 验证可信度,直指 OpenAI Navier-Stokes 证明(14 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →