人类论文反驳 OpenAI 3.7 万行 Lean 数学证明
量子位 · wechat · 2026-08-04
OpenAI 曾声称其下一代模型解决了 10 个世界级数学难题之一,包括 Connes 刚性猜想。但堪萨斯大学拓扑物理中心的 J.L. Nielsen 随后发文反驳:他把 OpenAI 公开的 3.7 万行 Lean4 代码逐条追踪后认为,这个“反例”并不成立。
Nielsen 的核心发现
- 他把单文件版 Lean 代码重新对回原始数学对象,指出了两条彼此独立的失败路径。
- 关键问题在于:AI 构造出的某个群看起来并不满足证明所需的附加条件,既不是 ICC,也没有性质 (T)。
- 他给出三种可能:性质 (T) 的形式化没有忠实对应原定义;证明只对局部成立却被外推到整体;或者代码里的群对象与说明文档中的描述不一致。
这件事的意义
- Lean 内核只能保证“形式上证明无误”,不能保证证明的命题真的对应原本想证明的数学结论。
- Nielsen 还把自己的两条反驳写成了 Lean 代码并成功编译,进一步说明:机器验证的是形式,不是语义。
- 论文把这件事放到更大的背景里:过去已经出现过空洞定理、错误公理和“证明了错误命题”的案例。
Connes 刚性猜想目前仍然是开放问题。
所属事件:OpenAI 数学证明遭人类专家接连质疑(3 条相关)→
「研究」频道最新
- 研究揭示 LLM 推理“过度思考”现象:思考越多反而越容易答错 — _jaydeepkarale · 2026-08-05
- NeurIPS 2026 首设扩散语言模型研讨会,聚焦基础与推理 — volokuleshov · 2026-08-05
- LLM 清理金融网络噪音,量化回测夏普比率升至 0.82 — iblanco_finance · 2026-08-05
- Apollo Research 深度解析:前沿 AI 模型的奖励寻求行为 — MariusHobbhahn · 2026-08-05
- AI 智能体模仿你时有多危险?新基准 AntiSkillBench 揭示隐私泄露风险 — Yongli Xiang · 2026-08-05
- 机器人能精准停手却看不懂全局进度?Gemini评测揭示隐患 — Crescitaly · 2026-08-05