OpenAI 新模型 88 小时攻破纳维-斯托克斯难题,陷入抢发争议
Don't Worry About the Vase (Zvi) · rss · 2026-09-13
Zvi 详解本周 AI 圈最大事件:OpenAI 的下一个内部模型(强于 Astra)在开始训练八天后,用 88 小时解决了千禧年大奖难题之一的纳维-斯托克斯方程有限时间爆破问题,随后 Astra 花 17 小时完成 Lean 形式化验证。OpenAI 称此举是让大家了解 AI 进展速度。
- 背景:数学家 Tristan Buckmaster 与 Levent Alpoge 基于 Diego Cordoba 和 Luis Martínez-Zoroa 多年构建的爆破方案,借助 LLM 推进到光滑外力与不可压 Euler 方程,并快速抢发论文,Buckmaster 甚至为写作质量道歉、自嘲像 AI slop,并公开呼吁给 Martínez-Zoroa 菲尔兹奖。
- 导火索:9 月 1 日 OpenAI 听到(不实的)「两个千禧年难题被解决」的传闻后,投入数百万美元推理算力(agent 发送 490 万条消息、约 3000 亿输出 token;仅 N-S 问题约 1300 亿 token),按公开价格折算约 2200 万美元,内部边际成本也要数百万美元。roon 称一年后这种 agent 集群成本会降到几美元。
- 争议:Buckmaster 指控 OpenAI 的 Sebastien Bubeck 先是误导他,随后提出两种方案:错开一天发布,或让 Buckmaster 单独署名并移除在 Anthropic 工作的 Alpoge 的作者身份,还出现「为什么你要毁掉自己的职业生涯」「你不想让我保持友善我就不友善」等施压言论。Buckmaster 拒绝并公开还原经过,强调未看到 OpenAI 的证明、不指控数据被用。Levent 侧则指出 OpenAI「无法排除其产品使用产生的去标识数据帮助改进模型」。
- 评价:作者认为三条故事线中,AI 攻破千禧年难题本身最重要;OpenAI 不打算领取百万美元奖金,这场争夺的核心从头到尾都是归属与声誉。
「模型」频道最新
- 博主吐槽 Claude 评测很好用起来诡异,疑后训练引入怪癖 — MaziyarPanahi · 2026-09-14
- 开发者吐槽 Claude Opus 5 本周又变笨了 — draginol · 2026-09-14
- 79K 参数小模型实测 RLT:能学状态追踪但长序列泛化差 — mike64_t · 2026-09-14
- 智谱融资 50 亿美元,六成投向下一代 GLM 与"自训练"递归循环 — teortaxesTex · 2026-09-14
- 用户吐槽 Opus 写作:「编造术语」像轻度煤气灯 — julianharris · 2026-09-14
- Ollama 联合创始人:小模型已能胜任大多数对话与推理场景 — ollama · 2026-09-14