OpenAI 内部模型攻克数百数学难题,解法全部上传 GitHub
AI寒武纪 · wechat · 2026-10-07
据该公众号转述,OpenAI 宣布其内部前沿模型产出一批数学新成果,已上传至 GitHub 仓库(openai/math),并附大量 Lean 形式化验证代码,相当于机器已对证明做核验。要点:
- 平均每题解法约消耗 ChatGPT Pro 深度思考三小时的算力;OpenAI 公开了 10 个模型推理摘要、尝试题量统计与算力开销估算,更多形式化代码将陆续补充。
- OpenAI 将出资赞助研讨会、学术会议与交流项目,帮助数学界消化这批成果,并推进安全评估、计划未来正式发布背后的模型。
- 普林斯顿高等研究院牵头成立数学与 AI 咨询小组,成员包括威滕、高尔斯、海尔等顶级学者;小组独立运作、不拿 OpenAI 报酬,曾收集 600 多份同行问卷制定发布准则。
- 专家组声明强调:人类吸收机器成果需要漫长过程,数学研究的未来不能变成人类只能被动理解 AI 内容,数学家必须保留提出自己问题的自由,普通科研人员也应能平等获取顶级 AI 工具与算力。
所属事件:OpenAI 开源内部模型的 700 余份数学手稿并发布进展报告(81 条相关)→
「研究」频道最新
- 把 Claude Code、Codex 等 10 个 harness 转 RL 环境,工具调用降 31% — vllm_project · 2026-10-07
- Google DeepMind 等发 IdeaLens:读大纲即可识别想法是否出自 AI — rohanpaul_ai · 2026-10-07
- Anima Anandkumar 首访联合国:AI for Science 的「静默革命」 — AnimaAnandkumar · 2026-10-07
- WRAP 框架用 Wasserstein 对抗训练解决非平稳市场深度对冲 — chaumian · 2026-10-07
- NYU 提出 CIA 指标:LLM 思维链仅 44.8%-75.9% 反映内部计算 — newyorkuniversity · 2026-10-07
- 牛津 AI Theorist 自主破解 α-RuCl₃ 光谱之谜,AI4Science 里程碑 — Oxford · 2026-10-07