OpenAI 数学家对谈:推理轨迹像极了人类专家做数学
a16z · youtube · 2026-09-08
a16z 基础设施合伙人 Lisha Li 与 OpenAI 数学家 Mehtaab Sawhney、Mark Sellke 深度对谈 AI 数学能力的进展。
- 关键结论:近期成果(球堆积进展、构造非 sofic 群等)的惊人之处不在于模型搜得更多、算得更久,而在于推理轨迹与人类专家极为相似——会选有希望的方向、失败会回溯、会组合跨文献的想法
- GPT-5 是转折点:两位从执业数学家转投 OpenAI 的研究者认为这是让他们「皈依」的时刻
- 训练洞察:数学论文是糟糕的训练集,因为成稿抹掉了真实的探索过程
- Astra 10 题集:两人逐题深挖模型的表现与 favorites
- 更宏观的讨论:harness 与模型本身哪个更重要、模型中的「品味」是什么、数学界应如何采用 AI、经验数学 vs 理论数学,以及 AI 产出超过人类吸收能力时数学会怎样——加速发现的模型也可能让复杂结果更易理解
所属事件:OpenAI 数学系统 Astra 连破十大开放问题(4 条相关)→
「漫话AGI」频道最新
- Hex 创始人撰文:数据分析师苦等「找洞察」的理想工作为何迟迟不来 — bennstancil · 2026-09-08
- Mastercard AI 负责人谈 Agentic Commerce:AI 引流已占零售 15-20% — AnneliesGamble · 2026-09-08
- 研究员评 prompt 署名权之争:能被多方同时逼近的问题多半不值得做 — samiramanabi · 2026-09-08
- 实验室安全合作再次落空,Gary Marcus 转发「百分百失调竞速」讽刺 — GaryMarcus · 2026-09-08
- OpenAI 陷千禧年难题风波,被指监控提示并施压剔除作者署名 — anshulkundaje · 2026-09-08
- NYT 记者 Kevin Roose:AI 实验室间的敌意比外界看到的更深 — kevinroose · 2026-09-08