OpenAI 内部模型展露数学「研究品味」,数学家惊叹其自创新技巧
aran_nayebi · x · 2026-10-07
转发的讨论汇总了多位数学家对 OpenAI 内部模型的评价,认为它已具备数学「研究品味」——通向自我改进(RSI)的最后一块拼图:
- jboggan 在 Hacker News 上谈模型对 Barnette 猜想的解答:「这个 aha 瞬间实在太野了……这是我第一次见到把复数根和消去项这样组合起来的用法,我不知道这个技巧从何而来。」
- Joshua Zelinsky 评价平面色数至少为 6 的证明:方法不见于既有文献,「远不止在已有方法上堆砌」。
- 对另外两个问题:「完全不是低垂的果实……AI 似乎在靠自己发明新技巧。」
作者认为这与 Tristan Buckmaster 对 Navier-Stokes 解法的看法一致:模型已能产出数学家认可的原创思路,而不只是复述已有文献。
所属事件:OpenAI 数学成果震动数学界:惊叹、质疑与职业焦虑齐发(47 条相关)→
「模型」频道最新
- SciCode 基准被指过时:>90% 通过率已难反映前沿 — geoffwolfe · 2026-10-08
- 同款模型表现迥异:Dylan Patel 谈 harness 如何改变 AI 性能 — MatthewBerman · 2026-10-08
- Unsloth 用 4GB 显存把 Qwen3.5 0.8B 决策准确率从 20.7% 提到 74.3% — kalyan_kpl · 2026-10-08
- 「速度狂热该停了」:开发者吐槽模型一味冲 tokens/s 牺牲质量 — casper_hansen_ · 2026-10-08
- 9B 索引配 0.6B 查询:pplx-embed-v2 同嵌入空间实现跨模型检索 — antoine_chaffin · 2026-10-08
- 0.6B 视觉检索模型媲美 8B 级对手,文档检索不牺牲图像搜索 — antoine_chaffin · 2026-10-08