数学教授评级 OpenAI 722 项成果:多数 B/C 级,一项达「准黎曼猜想」级
khademinori · x · 2026-10-08
OpenAI 官宣发布由内部前沿模型产出的一系列新数学成果,并与高等研究院的数学与 AI 独立顾问组沟通发布策略。伦敦数学教授 Abhishek Saha 将重大数学成果分为四级:A(扎实常规)、B(顶刊级突破)、C(改变领域的意外突破)、D(专家认为当前几乎不可能的震撼突破)。他对 OpenAI 这批成果的判定:部分为 A 级,多数为 B 或 C 级,恰有一项 D 级——即被称为「准黎曼假设」的结果。他评价:「对数学来说是非常重大的一天。」最惊人的是,这一切来自一个未发布的模型,每项成果约只需 3 小时思考时间。OpenAI 也表示部分证明尚未完全确认。
「模型」频道最新
- LMArena 上架 Claude Haiku 5.5,可Battle与Agent双模式实测 — arena · 2026-10-08
- 把 GPT、Claude、Grok 塞进真车去买汉堡,只有一家成功了 — nordicinst · 2026-10-08
- 浏览器版 ChatGPT 现降级提示:「能力受限,回复质量可能下降」 — jasondeanlee · 2026-10-08
- Reddit 实测:同额度下 Work 模式比 Codex 模式更能打 — sasik520 · 2026-10-08
- Epoch发布InnovationEval:AI做出重大创新的能力仍远不达标 — Afinetheorem · 2026-10-08
- 三周冒出 113 个决策模型:七成基于 Qwen,最便宜的不到一厘钱 — jonathanmalkin · 2026-10-08