OpenAI 开源 722 份 AI 数学手稿,社区反应两极
OpenAI 于 10 月 7 日官宣发布由内部前沿模型产出的一批新数学成果,并在 GitHub 开源 openai/math 仓库,同时公布矩阵乘法指数上界降至 9/4(约 O(n^2.25))的结果,被称为 47 年来最大降幅。这批成果因规模空前、直指悬置数十年的难题且由 AI 模型产出而引发数学圈与 AI 社区震动,Mathocalypse 式的批量发布开创了 AI 科研产出的先例,但验证能力已成为新瓶颈。
已确认
- OpenAI 官方发布博文《Sharing AI progress in mathematics》并开源 openai/math 仓库,收录 722 份手稿(附证明材料,分为 lean 形式化证明、preprints、reasoning traces 等目录)、覆盖 372 个结果族;据 @WorldofAI、@DrSingularity 转述,模型在约 4000 道公开研究问题上测试后产出这些成果,涉及 π、Mahler 猜想、NP-hardness、自旋玻璃、量子磁性、自由群因子等。Scientific American 也对此做了报道,称数学界在前一批成果的震惊中再受冲击。
- 发布方式上,OpenAI 咨询了普林斯顿高等研究院(IAS)的「数学与人工智能独立顾问组」;据 @emollick 转述 Scott Aaronson 博客《The Mathocalypse》,该顾问组成员包括 Timothy Gowers、Edward Witten 等,372 项成果系在其建议下一次性发布。据 @matthewdgreen 转发,成果中还包括通用量子分解(quantum factoring)问题的进展。
- 据 @physiopeng 转述 Reddit 爆料,继上月的 Navier-Stokes 问题之后,该内部模型声称又拿下另外两道千禧年大奖难题的部分成果。此前 Navier-Stokes 反例相关公告已被 @mathandcobb 质疑为 PR 秀,@tszzl 回应称这些工作出自公司里「前世是数学家」的研究员,不为商业、只为真理。OpenAI 高管 Mark Chen 评价称,模型一周内完成了代表数学界十年进步的工作量,并表示要用这些工具进军生命科学。
- 矩阵乘法:据 @Pascallisch 转述 RokoMijic 的说法,OpenAI 证明矩阵乘法可只用 O(n^2.25) 次运算完成,刷新此前约 O(n^2.37) 的纪录,出自日期为 2026 年 10 月 2 日的 OpenAI 未经审稿预印本,由内部模型产出;@BorisMPower 的转发也称这是 47 年来最大降幅。历史脉络上,1969 年 Strassen 将指数降到 2.81,1990 年 Coppersmith–Winograd 达到 2.376 后纪录长期近乎停滞;据 @mtizard 转述,新纪录超越了 AlphaEvolve 七周前的成果。
- 斯坦福教授、Matrix$$ 创始人 Reza Zadeh 于 10 月 7 日发帖宣布自己发现了一个更快的矩阵乘法算法并附论文与代码;他随后称「有趣」——在他发布材料几小时后 OpenAI 就公布了 2.25 的结果,并祝贺 OpenAI 与全人类。
- 具体成果案例:据 @Anen-o-me 转述专家评论,OpenAI 对 #180 Barnette 猜想给出的解法中,关键「aha」洞察涉及边上的一种复值指数和,用复根与相消项做计数论证,该专家称在图论中首次见到此类技巧。Reddit 讨论中也有人(转述 Prinz 的推文)认为这批结果最有趣之处不是原始解题能力,而是模型展现的「研究品味」——选题与判断的直觉。
- OpenAI 研究员 Noam Brown 转引同事 Mark Chen 的观点称,LLM 已跨过一道重要门槛:在某些科研问题上超越了顶级人类专家。
- @willdepue 让 GPT 6 Pro 和 Fable 5.1 给近三年的「发现」排序并按来源标色,称前 20 项中约 13% 为人类发现,今日发布即占约 59%(另一帖称 81%/87% 为 AI 做出,数字略有出入,均为个人实验性质的粗略统计)。
尚未确认
- 722 份手稿与 O(n^2.25) 预印本均未经同行评审;矩阵乘法结果据称尚无具体算法构造,Navier-Stokes 反例与两道千禧年难题的部分成果也待专业验证。据 @emollick 转述 Scott Aaronson 的说法,数学家坦言这批成果「无人读得懂」;@Wes Roth 指出验证已成新瓶颈,@norsurfit 与 @haider 观察到社媒解读泡沫与数学社区的集体沉默,@petburiraja 收集的 r/mathematics 讨论也显示社区态度两极,有人惊叹进展、有人质疑抵触。
- 顾问组的角色本身出现争议:据 @Charuru 引述,「数学与人工智能顾问组」的声明称前沿 AI 公司不应在内部模型上测试高级数学难题,被解读为 OpenAI 未完全遵循科研规范的建议。
- Reza Zadeh 关于各大 AI 实验室内部已掌握接近指数 2 方法的说法仅为个人猜测;其个人成果与 OpenAI 结果之间的关系也有待澄清。@kimmonismus 称「多位顶尖数学家确认为历史性突破」,未给出具体人名。@emollick 另讽刺 AI 圈大 V 每逢数学突破便集体装懂数论发表高见,提醒对社媒解读保持警惕。
为什么重要
- 矩阵乘法指数 ω 决定一切矩阵计算的理论速度上限,直接关系大模型训练与推理成本;该纪录三十年来近乎停滞,如今短时间内被 AI 模型接连刷新,凸显 AI 方法反哺基础算法研究的潜力。
- 722 份手稿的批量发布标志着 AI 首次系统性进入研究级数学产出,且发布流程由 IAS 顾问组参与把关,为「AI 科研成果如何进入学术共同体」提供了先例;但顾问组内部对测试方式的异议、以及验证体系的缺位若不补齐,可能限制这类成果的实际学术价值。
2026-10-07 ~ 2026-10-08 · 246 条相关
- 第 1 集:OpenAI 开源 722 份 AI 数学手稿,社区反应两极(2026-10-07,246 条)
- 第 2 集:OpenAI 快速矩阵乘法算法证明被推广至任意域(2026-10-07,2 条)
一手来源
- OpenAI 开源内部前沿模型产出的 722 份数学新结果 — OpenAI ·
- OpenAI 一次性发布 372 项数学证明,数学家称「无人读得懂」 — emollick ·
- OpenAI 被指无视科研规范,顾问组称不应拿前沿数学问题内部测试 — Charuru ·
- Reza Zadeh 称找到更快矩阵乘法算法,猜测大厂已接近指数 2 — Reza_Zadeh · 2026-10-07
- 【源头】OpenAI 开源内部前沿模型产出的 722 份数学新结果 — OpenAI · 2026-10-07
- OpenAI 公开数学证明材料,呼应此前数学突破传闻 — imjustnewatai · 2026-10-07
- OpenAI 放出内部模型数学手稿仓库,含未形式化证明与推理轨迹 — aran_nayebi · 2026-10-07
- OpenAI 回应:发布内部前沿模型产出的新数学成果 — kimmonismus · 2026-10-07
- OpenAI 公开未发布内部模型产出的 722 篇数学论文 — kimmonismus · 2026-10-07
- Mistral 研究员转发:模型解决重要数学问题,博客已发布 — charliermarsh · 2026-10-07
- OpenAI 官方发布数学进展报告:公开模型攻克数学难题的方法与成果 — AMBNNJ · 2026-10-07
- OpenAI 一次放出 722 篇数学论文,内部模型疑似证得拟黎曼猜想 — imjustnewatai · 2026-10-07
- 团队成员亲历:AI 模型在十年悬而未决的数学问题上取得进展 — ctjlewis · 2026-10-07
- OpenAI 前沿模型产出数学新成果:涉黎曼猜想等三大千禧年难题 — apples_jimmy · 2026-10-07
- OpenAI 官宣前沿模型产出大批数学新成果,普林斯顿高研院顾问把关 — IgorCarron · 2026-10-07
- OpenAI 用未发布前沿模型产出大批新数学成果,每题烧 3 小时 Pro 算力 — gaganghotra_ · 2026-10-07
- 曝 OpenAI 突然放出近千篇数学预印本,规模惊人 — airkatakana · 2026-10-07
- OpenAI 研究员感慨内部模型连解多年仰望的难题:「智能观的哥白尼式转变」 — weijie444 · 2026-10-07
- 继 Navier-Stokes 后,OpenAI 内部模型再声称攻克两道千禧年难题部分内容 — physiopeng · 2026-10-07
- GPT 6 Pro 盘点近三年发现:81% 由 AI 做出今日发布 — willdepue · 2026-10-07
- 三年数学大发现榜单:AI 占 87%,人类仅剩 13% — willdepue · 2026-10-07
- 数学家发现沙法列维奇猜想两个反例,littmath 调侃「重复计数」 — littmath · 2026-10-07
- daniel_mac8:OpenAI 数学成果被公关性淡化,数学只是开始 — inductionheads · 2026-10-07
- OpenAI 用内部模型产出数百个高难度数学证明并开源发布 — Pascallisch · 2026-10-07
- 数学家追问 OpenAI「千禧年难题进展」到底指什么 — littmath · 2026-10-07
- OpenAI 发布前沿模型数学成果:矩阵乘法指数降至 2.25 — inductionheads · 2026-10-07
- OpenAI 发布数学成果,数学系学生自嘲「被抢发了」 — littmath · 2026-10-07
- Ethan Mollick 讽刺:AI 大V们又集体装懂数论评点数学突破 — emollick · 2026-10-07
- OpenAI 数学成果刷屏:7/8 准黎曼猜想证明引热议 — Singularitarian · 2026-10-07
- OpenAI 发布预印本:整数乘法算法首次突破 n log n — Singularitarian · 2026-10-07
- OpenAI 发布内部前沿模型产出的新数学成果,被指部分早已被 agent 解出 — repligate · 2026-10-07
- 陶哲轩关注 OpenAI 手稿:Q_p 上的 Section 猜想进展最有意思 — littmath · 2026-10-07
- 4000 题仅 372 组成功,OpenAI 数学手稿成功率引热议 — basedjensen · 2026-10-07
- OpenAI 发布前沿模型数学新成果,称已解 90 个顶级未解难题 — inductionheads · 2026-10-07
- OpenAI 内部模型攻克数百数学难题,解法全部上传 GitHub — AI寒武纪 · 2026-10-07
- OpenAI 开源 math 仓库:六维互无偏基上界的 Lean 形式化 — MarioKrenn6240 · 2026-10-07
- 「一次包揽 STOC、FOCS、SODA」:学者用一句话点出 OpenAI 数学结果的分量 — giannis_daras · 2026-10-07
- OpenAI 前沿模型给出「准黎曼猜想」结果,数学家惊呼:人类做到可直接拿菲尔兹奖 — soumitrashukla9 · 2026-10-07
- Unique Games 猜想传闻被证实,数学界为之震动 — felpix_ · 2026-10-07
- OpenAI 发布模型产出的数学结果包:疑似准黎曼假设与希尔伯特第十问题 — repligate · 2026-10-07
- OpenAI 数学成果包:BSD 猜想大量情形获证、L 函数零点区扩至 Re(s)>7/8 — snikolov · 2026-10-07
- OpenAI 首席数据官 Kevin Weil 盛赞数学结果发布:下一个目标是物理科学 — kevinweil · 2026-10-07
另有 11 条近重复转述:Reza_Zadeh · apples_jimmy · felpix_ · nabla_theta · rand_longevity · willdepue · AlexTensor · Justin_Halford_ · ctjlewis · kristoph · ZeroStateReflex