陶哲轩长文回应AI破解纳维斯托克传闻:反对只为跑分的数学竞赛
量子位 · wechat · 2026-09-06
传闻称 Claude 破解了千禧年难题纳维斯托克方程,陶哲轩专门发长文回应:自己未参与、不知情,但借机提出对 AI 基准测试文化的深层担忧。
- 导火索:数学家 Julia Stadlmann 在 arXiv 上传 34 页论文,将相邻素数间隔上界从 246 推进到 240,是 12 年来首次进展,耗时两年、未用任何 AI 工具。因听说 OpenAI 即将发布同题成果,她被迫提前上传,坦言无法与公司算力竞争。三四天内,Claude Opus 5.1 报 260、Axiom Math 报 220、GPT-6 Astra 报 186(未经验证)。
- 思想实验:陶哲轩推演「假如 AI 早来 20 年」——GPY 方法公布后 AI 公司蜂拥刷榜,问题被「饱和」,无预印本、无教科书内容、无后续方法,张益唐还在刷盘子,Maynard 转行。他回顾 2013 年真实的抢跑竞赛如何被 Polymath8 协作化解,最终产生 Maynard 筛法等教科书级成果。
- 核心观点:援引 Goodhart 定律指出,为单一指标优化不等于推动数学理解;真正的机会成本是让成果丰硕的问题沦为病毒式营销素材。他明确表示不是反对 AI(Erdős 问题就是正面的协作案例),而是反对放弃人类理解、不做同行评审、纯刷基准数字的做法。
- 背景:陶哲轩对 AI 数学能力的评估持续修正,2026 年已在国际数学家大会提出或许应让某些数学问题对自动求解器「禁入」;国际数学家联盟的《莱顿宣言》也警告 AI 生成证明威胁数学的可验证性。他建议 AI 公司:与其抢先宣布解决未解难题,不如率先宣布新的数学见解。
所属事件:陶哲轩长文回应AI破解纳维斯托克斯传闻(2 条相关)→
「漫话AGI」频道最新
- All-In 播客热议:Hugging Face 事件被媒体过度渲染成阴谋叙事 — rohanpaul_ai · 2026-09-06
- 观点:AI 或让传统数学研究方式在几代内消亡 — burny_tech · 2026-09-06
- 模型语义搜索或让研究生偏离「攻克难题」式数学发现 — burny_tech · 2026-09-06
- 研究者担忧:AI 使网络防御提升 100 倍但攻击差距仍难弥合 — dan_s_becker · 2026-09-06
- 算力够吗?Reddit 热议自动化全部脑力劳动的能源门槛 — Vivid-Flamingo-644 · 2026-09-06
- 被低估是最便宜的杠杆:无人审视时才能安静复利 — signulll · 2026-09-06