OpenAI 开源 722 篇数学手稿,覆盖 372 项开放问题结果
FinanceYF5 · x · 2026-10-10
OpenAI 公开了此前「内部模型解决开放数学问题」声明背后的完整材料,托管在 GitHub 的 openai/math 仓库(已获 1.3 万+ star),包含数学手稿与证明辅助材料。
- 共 722 篇数学手稿,覆盖 372 项重要结果;目录来自对内部模型约 4,000 个研究问题的测试,再归类筛选而成
- 几乎所有结果采用同一套标准流程,每项成果平均消耗相当于 ChatGPT Pro 思考 3 小时的算力
- 仓库含 lean 形式化、preprints、reasoning traces 等目录;部分结果尚无 Lean 形式化,OpenAI 承认可能有误并将持续修复更新,还在探索社区托管方案
- 背景是现有数学评测已饱和,OpenAI 转而在开发中用开放研究问题评估模型
所属事件:OpenAI 单日放出 722 篇 AI 数学论文引发学界震动(12 条相关)→
「研究」频道最新
- 小米 MiMo-V2.6 论文:AI 自建任务自查作弊,260 万美元 RL 把 DeepSWE 刷到 72.6 — rohanpaul_ai · 2026-10-10
- 3SUM 问题最快确定性算法刷新:n^1.9961 突破 n² — basedjensen · 2026-10-10
- OpenAI 纳维-斯托克斯证明争议拆解:Lean 版可自动验证,人读版被挑出漏洞 — qi2peng2 · 2026-10-10
- Google 团队论文:把模型路由建模为 Pandora's Box 代价搜索问题 — _onionesque · 2026-10-10
- QWM 方法细节:形态编码器+自适应奖励归一化+潜在形态条件化 — breadli428 · 2026-10-10
- 事实性评测需要重构,相关论文获 COLM workshop 最佳论文奖 — caglarml · 2026-10-10