专题 · FULL STORY

OpenAI宣称攻克千禧年难题的传闻链条

9月初X平台流传GPT-6攻克纳维-斯托克斯方程的传言,随后OpenAI宣称以约一万个协作Agent完成该难题证明,并称在另一千禧年难题上有实质进展;同期还流出其逼近霍奇猜想、竞速BSD乃至冲击黎曼猜想与P vs NP的爆料,引发广泛质疑与讨论。

2026-09-05 ~ 2026-09-11 · 6 集 · 53 条

第 1 集 · 传言称 GPT-6 攻克纳维-斯托克斯难题,可信度存疑(2026-09-05,2 条)

X 用户 xdotli 放出消息暗示 GPT-6 将解决纳维-斯托克斯方程这类千禧年大奖难题;博主 scaling01 也给出概率判断,认为 30% 的可能 OpenAI 已经解决该问题,50% 的可能取得了部分进展。不过这些均为圈内传闻,转发者 teortaxesTex 也调侃说不清具体指哪个难题、只是蹭热度,消息可信度存疑。

第 2 集 · OpenAI 万个 Agent 88 小时宣称破解 Navier-Stokes 难题(2026-09-09,13 条)

OpenAI 宣称其一个仍在训练中的内部模型(据 @r0ck3t23 转述强于市售的 GPT-6 Astra)动用约 1 万个相互协作的 AI agent,在 88 小时内解决了 Navier-Stokes 方程解的存在性与光滑性问题的两个关键界,全程执行前沿评估级别的安全监控与隔离措施。解法论文已在 OpenAI 官网开放,据 @AGI Hunt 整理附有 Lean 形式化验证;Quanta Magazine 报道称智能体在方程中找到了「奇点」,可能标志数学研究方式的重大转变。Ben Goertzel 估计 OpenAI 为此投入约 2200 万美元算力(@AGI Hunt 称耗费数百万美元,两说并存)。这是 AI 系统首次大规模攻克顶级数学难题,但目前仍以 OpenAI 单方面宣称为准。Two Minute Papers 已发布视频解读。

已确认

  • OpenAI 于 9 月 8 日前后表示:内部模型在 88 小时内解出 Navier-Stokes 问题的部分证明,动用约 1 万个协作 agent,并声称在众多基准上实现「阶跃式」提升;解法论文已在官网开放。
  • 据 @AGI Hunt 整理,证明附 Lean 形式化验证,算力耗费以百万美元计,折算相当于一个极度聪明的人不吃不喝连续工作约 100 年。
  • 问题的历史脉络:1934 年 Leray 证明弱解存在,但解是否保持光滑悬置 90 年;2000 年被 Clay 数学研究所列为百万美元悬赏的七大千禧年难题之一。Navier-Stokes 是流体运动方程,涉及机翼气流、血液流动、天气与海洋等现象。
  • @bengoertzel 评述 OpenAI 投入约 2200 万美元算力用于此次求解。

时间线

  • 据 @haider1 整理:8 月 28 日重启 RL 训练;9 月 1 日模型被派去攻千禧年大奖难题,开始 88 小时求解运行时模型仅训练 4 天;一两天后团队切换到更好的 checkpoint,最终产出 Navier-Stokes 解答——此时初始训练甚至尚未跑完。

尚未确认

  • 内部模型的具体能力细节、与市售模型的差距,以及最终是否通过完整同行评议获得 Clay 奖金,均以 OpenAI 单方面宣称为准,尚待独立验证;@AlexTensor 也以「科幻新闻」口吻转述,指尚无论文或官方公告佐证(该帖早于论文开放)。
  • 据 @eyishazyer 转述,数小时内讨论焦点已从数学本身转向「功劳归属」的争论,相关争议细节尚无定论。

为什么重要

  • @kacoef 指出这则新闻与 ZrTe₅ 量子实验突破暗藏同一套理论交点,暗示 AI 可能在多个前沿科学领域复用同一数学能力。
  • @robleclerc 让 Grok 复盘后认为「作为数学终点并不意外」:Córdoba–Martínez–Zoroa 早已建立逐尺度放大加光滑外力的研究纲领,Alpög 等前人工作已铺路,AI 的成功是站在巨人肩膀上的必然一步,而非凭空创造。

第 3 集 · 「存在性证明」效应:传闻可行就促 OpenAI 攻克难题(2026-09-09,3 条)

围绕 OpenAI 求解 Navier-Stokes 方程的讨论中,多位评论者提出「存在性证明」的观点:一旦知道某事可行,就会被迅速做成,正如四分钟一英里纪录被打破后纷纷有人跟进。有说法称 OpenAI 正是在听闻「这个问题可解」的网上传闻后才着手尝试。评论者认为 AI 将加速这一趋势——只要知道思路可行,攻克难题的速度就会大幅提升。

第 4 集 · 传 OpenAI 逼近霍奇猜想验证,与 Anthropic 竞速 BSD(2026-09-10,19 条)

9 月 10 日起,X 平台集中流传一则匿名爆料:OpenAI 非常接近验证 Hodge 猜想的一个证明,同时 OpenAI 或 Anthropic 之一也可能接近解决 Birch–Swinnerton-Dyer(BSD)猜想。两者均为克雷数学研究所千禧年七大难题,每题悬赏 100 万美元。爆料出现的前两天,OpenAI 刚宣布用约 10000 个 agent、耗时 88 小时攻破 Navier–Stokes 方程,附 166 页论文并经 Lean 形式化验证;《纽约时报》特稿也确认了这一成果,这为后续传闻提供了发酵背景。转述称 OpenAI 已向《纽约时报》承认在某个千禧年难题上有「实质性进展」并正准备宣布,截至发稿仍无官方公告或独立数学家佐证,核心事实层面应视为传闻。

已确认

  • OpenAI 宣布以约 10000 个 agent、88 小时攻破 Navier–Stokes 方程,附 166 页论文与 Lean 形式化验证,《纽约时报》特稿予以确认;据 @新智元 与 @创业邦 整理,霍奇猜想传闻正是在此两天后出现。
  • 传闻的传播本身属实:@kimmonismus、@DrSingularity、@zephyrz9、@TheGoldenLeaper 等多位用户于 9 月 10—11 日转发或整理同一消息,@basedjensen、@joshwills、@shyamalanadkat、@soumitrashukla9 亦有转发扩散。
  • @DrSingularity 整理了七大难题现状:目前仅庞加莱猜想被 Perelman 证明。
  • 多位发帖者(如 @zephyrz9、@basedjensen、@shyamalanadkat)明确强调消息未经证实;爆料者还称幕后「争当下一个」的竞赛烈度前所未见。
  • @thesaraharminta 转述 Andrew Curran 的说法:OpenAI 已向《纽约时报》证实,最近五天内在另一个千禧年大奖难题上取得「实质性进展」,正准备对外宣布。此为目前最接近一手的进展信息,但仍属转述,未见图纸级证据。
  • @adonissingh 与 @imadade 补充了可核查的技术侧信息:代号 Bel 的模型在 OpenAI 精选的公开数学题集上得分约 50%,该模型推测于 8 月 28 日才开始 post-training;@adonissingh 认为业界对此不必惊讶,而 @imadade 转述讨论称,若 Bel 产出关于 Navier–Stokes、Hodge 猜想乃至 BSD 猜想的证明成立,Bel 将成为有史以来需求最高的模型——该判断同样建立在未经证实的传闻之上。
  • @begusgasper 从另一个角度回应传闻:认为若 AI 能快速攻克可证明的问题,学术界应回归人文学者式的思辨传统,并以 15 世纪学者 George of Trebizond 为例说明批判性写作的持久价值。

尚未确认

  • 「OpenAI 接近验证 Hodge 猜想证明」来源不明,均为匿名爆料,无官方声明或独立数学家佐证。
  • 「OpenAI 或 Anthropic 接近解决 BSD 猜想」同样无佐证,连具体是哪家公司都不确定。
  • @DrSingularity 帖中「Navier–Stokes 已被 OpenAI 解决」的说法与 OpenAI 已公开宣布的成果在传播中相互印证,但帖内将其与 Hodge、BSD 传闻并置形成的「几天一个」攻克节奏,仍属传言层面的叠加。
  • Andrew Curran 所述「实质性进展」针对的是哪个难题、进展到何种程度,均未明确。

为什么重要

  • Hodge 猜想与 BSD 猜想是代数几何与数论的核心问题,若由 AI 参与攻克,将是继 Navier–Stokes 之后 AI 辅助数学研究的又一标志性事件,可能引发对 AI 科研能力的重新定价。
  • Navier–Stokes 的正式攻克(10000 个 agent、88 小时、Lean 形式化验证)已使「AI 连破千禧难题」从纯炒作转为有先例支撑的观望状态;@zephyrz9 提到若传闻属实,多个千禧年难题可能在一个月内相继被破,需警惕消息在传播中被层层放大。
  • Bel 模型在 OpenAI 数学题集约 50% 的得分提供了内部模型能力的旁证参照,但在官方公告或可验证论文出现前,Hodge 与 BSD 相关传闻整体仍应按传闻对待。

第 5 集 · OpenAI 宣称攻克 Navier-Stokes,称另一千禧年难题有实质进展(2026-09-10,13 条)

OpenAI 在接受《纽约时报》采访及周三晚间声明中表示,已完成 Navier-Stokes 方程存在性与光滑性问题的证明,并称自该问题完成以来,已在另一个千禧年大奖难题上取得实质性进展,正考虑如何「审慎地分享这些成果」。这使 OpenAI 短时间内两度逼近克雷数学研究所悬赏的千禧年大奖难题,引发数学界与 AI 界高度关注,围绕成果归属与学术流程的争议同步发酵。

已确认

  • OpenAI 在《纽约时报》采访及声明中表示已完成 Navier-Stokes 问题的证明,且在另一个千禧年难题上取得实质性进展,但未披露具体是哪一道题,只称正考虑如何妥当公布。
  • 据《纽约时报》报道,Navier-Stokes 相关工作与 NYU 数学家 Tristan Buckmaster 及其合作者有关。
  • 七大千禧年难题每道悬赏 100 万美元,目前仅庞加莱猜想已被解决。

尚未确认

  • 另一个取得进展的难题具体是哪一道,OpenAI 官方未披露。公众号「AI寒武纪」称其为霍奇猜想,并传 Anthropic 接近解决伯奇-斯维讷顿-戴尔猜想,若坐实三大难题将同期被攻克,但这些说法均未见一手信源证实。
  • Navier-Stokes 证明本身尚未经公开的完整同行评审,数学正确性仍待确认。
  • 据 @basedjensen、@rohanpaulai 转述的报道,8 月 Buckmaster 与合作者取得重大进展后,OpenAI 在不到一周内抢先公布答案;@socoolandawesome 也指出外界对 Levent/Buckmaster 相关工作的归属与学术流程存在质疑,具体细节尚待核实。

为什么重要

  • 千禧年大奖难题是数学界最高难度的问题之一,AI 实验室介入并宣称攻克,可能重塑数学研究与 AI 能力评估的格局。@DrSingularity 据此预测至少 3 个千禧年难题可能被陆续解决。
  • @AndyMasley 借此讨论递归自我改进:如果 AI 能持续解决千禧年难题,它对 AI 研究本身的加速作用值得重视。
  • 抢先公布合作者成果的做法若属实,将引发关于学术信用分配与 AI 实验室行为规范的讨论。
  • @robleclerc 从另一角度发问:如果 AI 能解决长期悬而未决的数学难题,就没有理由认为 AI 无法缓解 AI 自身安全的最坏风险——这也为「AI 安全难以研究」的说法提供了反驳。
  • 数学界反应已现:PDE 分析师 Scott Armstrong 以社区口吻发帖,希望 OpenAI 转向其他难题,称纳维-斯托克斯被解后 PDE 界感觉被针对,代数几何界则幸灾乐祸。
  • @AlertCookie633 翻出今年 5 月与 ChatGPT 的对话:当时模型预测七大难题中下一个最可能被解决的是 Navier-Stokes,如今恰被印证,成为趣味注脚。

第 6 集 · 曝 OpenAI 内部模型冲击黎曼猜想与 P vs NP 难题(2026-09-11,3 条)

据 Andrew Curran 在 X 上转述及 @MTSlive 爆料,OpenAI 正在用一个内部新模型尝试攻克黎曼猜想、P versus NP 等千禧年大奖难题,以及其他一些未公开的「高影响力问题」。该模型据称就是此前产出 Navier–Stokes 方程证明的那个模型。目前尚无官方细节,消息可信度较低。