专题 · FULL STORY

OpenAI开源722份数学成果引热议

10月7日OpenAI发布由内部前沿模型产出的722份数学研究成果并配发官方博客,随即引发热议。多位博主爆料称其未发布模型已证明拟黎曼假设并附Lean形式化证明,另有传闻称这只是三批成果中的首批,后续仍有两批待发布。

2026-10-07 ~ 2026-10-08 · 3 集 · 143 条

第 1 集 · OpenAI 开源内部前沿模型的 722 份新数学成果与推理轨迹(2026-10-07,137 条)

10 月 7 日,OpenAI 正式发布由内部前沿模型产出的一批新数学研究成果,配套官方博客《Sharing AI progress in mathematics》,并在 GitHub 开源 openai/math 仓库,收录模型生成的数学手稿与证明辅助材料(含 preprints、reasoning traces、Lean 形式化证明)。这被视为前沿实验室首次大规模系统性公开模型生成的原创数学研究成果,数学与推理方向研究者高度关注,社交媒体随之刷屏,但各项证明的正确性尚待数学界正式审读。

已确认

  • OpenAI 官宣发布内部前沿模型产出的数学新成果并开源 openai/math 仓库,官方口径为 722 份手稿(@OpenAI、@gdb、@DrSingularity 等多数帖子一致),个别帖子(@applesjimmy)写作 772 份,应以官方仓库为准
  • 发布前咨询了普林斯顿高等研究院(IAS)的「数学与人工智能独立顾问小组」,并依据其公开建议决定发布方式
  • 成果按约 372 个结果族组织:模型先在约 4000 个公开研究问题上测试,再分组筛选产出(@DrSingularity、@WorldofAI 等),几乎全部来自同一标准设置;@WorldofAI 称该未公开模型即社区讨论中的 GPT-7「Bel」预览版,属第三方推测
  • 据数学界研究者转述,这些结果声称解决 100 多个长期开放问题,亮点包括黎曼猜想、Hodge 猜想、BSD 猜想等千禧年难题的部分进展;7/8 准黎曼猜想(quasi-Riemann hypothesis)证明;矩阵乘法指数下界降至 n^2.25;预印本《Integer multiplication below n log n》;涉及「一致的无零点带」及排除 Siegel 零点的数论结果;@ctjlewis 转发中物理学家 Steve Hsu 指出多项结果属理论/数学物理领域(如量子相关内容);@DrSingularity 转述还提及 π、Mahler 猜想、NP-hardness、自旋玻璃、量子磁性、自由群因子等
  • 普林斯顿数学家 Mathieu Laurière(littmath)指出材料中出现 Shafarevich 猜想的两个反例,并调侃作者「double-dipping」;他另确认 OpenAI 内部提出的问题并非刻意安排,而是由曾是数学家的研究员出于好奇自发追问,并表示愿意分享已获得的部分结果
  • 上月已有 Navier-Stokes 相关成果,本次为后续批量发布(@physiopeng 援引 Reddit 爆料,@kimmonismus 亦提及,称内部模型数月内攻破数百道悬置数十年的难题)

尚未确认

  • 个别帖子的 772 份口径与主流 722 份数字不一致,需以 openai/math 仓库为准
  • 产出这批成果的模型身份未获官方确认;@WorldofAI 称其为 GPT-7「Bel」预览,属社区推测
  • @markjeffrey 转发的「AI 已解答 500 个数学开放难题中的 90 个」为第三方汇总口径,非 OpenAI 官方数字
  • @willdepue 让 GPT 6 Pro 与 Fable 5.1 对近三年发现排序,得出前 20 项中约 13% 为人类发现、87%/81% 由 AI 做出、今日发布占比 59% 等比例,属个人实验口径
  • 各项证明的正确性与可验证性尚待数学界正式审读;littmath 等数学家公开追问「千禧年难题实质性进展」具体指什么,表示未在材料中找到对应说法;Elliot Glazer 揶揄所谓进展不过是 Shafarevich 猜想的两个反例;@norsurfit 转载 Reddit 讽刺帖,指社交媒体上大量围观者并不真正理解内容;@Wes Roth 亦指出随着 AI 推进到前沿数学,验证本身正成为新瓶颈
  • @bindureddy 称 AI 解题数量超过人类十年规模、并预期 AI 很快在所有科学问题上取得类似突破,原帖未给出具体基准与题数,属个人判断

为什么重要

  • 首个前沿实验室按 IAS 顾问组建议选择可验证方式大规模公开模型生成的数学研究,回应了「别只发博客、要拿出可验证证明」的呼声;@tszzl 在回应 @mathandcobb 的「PR 秀」质疑时称此举不为商业、只为真理,问题多出自公司里「前世是数学家」的研究员,littmath 亦予佐证
  • 哈佛数论学者 Alpoge 称拟黎曼假设相关结论与排除 Siegel 零点是「数学史上最显著的时刻」;Alex Kontorovich 认为若由人类做出可直接拿菲尔兹奖;cremieuxrecueil 称 7/8 准黎曼猜想证明是分析数论数十年来最重要进展之一
  • OpenAI 首席数据官 Kevin Weil 盛赞此次发布,并表示下一个目标是让模型在物理科学领域达到同等水准;Mistral 核心研究员 Théophane Sottiaux 转发称之为「科学进步的非凡新纪元」
  • @haider1 观察到最大的数学 subreddit 在消息发布后集体沉默,调侃多年唱衰者噤声,侧面反映数学社区对这一突破的复杂心态
  • 数学家 littmath 进一步追问这些内部问题究竟是个人兴趣还是被纳入了某个 benchmark,凸显 AI 生成研究如何被评价与吸纳进学术体系这一开放问题

还有 117 条相关讨论 →

第 2 集 · 传闻 OpenAI 未发布模型证明拟黎曼假设并附 Lean 证明(2026-10-07,3 条)

多位博主爆料称,OpenAI 一款尚未发布的 AI 模型证明了拟黎曼假设(quasi-Riemann hypothesis),并随论文一同公开了 Lean 形式化证明。另有博主称 OpenAI 似乎在黎曼猜想这一数学难题上取得重大突破,并讽刺圈内人仍以 Pangram 检测分数炫耀「纯人类」创作。需要强调的是,该说法目前均为未经证实的传闻。

第 3 集 · 传 OpenAI 数学成果仅发首批,还有两批待发布(2026-10-07,3 条)

10 月 7 日多方传闻称,OpenAI 近日发布的由内部前沿模型产出的大批数学研究成果(首批已含 722 份手稿)只是三批中的第一批。消息最早由 NYU 一位数学教授在 X 上透露,另有爆料者称已从两个不同信源听到同样说法,称 OpenAI 手中还压着两批证明尚未公开。该说法目前未经官方证实,若属实则后续还有两波数学相关成果待发布。