OpenAI 与 Anthropic 前沿数学竞赛:Astra 领跑 24 小时被追平
新智元 · wechat · 2026-08-03
上周末,OpenAI 与 Anthropic 在前沿数学领域展开了一场激烈的 AI 竞赛。
事件脉络:
- OpenAI 发难:8 月 1 日,OpenAI 研究员宣布其未公开的下一代模型 Astra 成功证明了 10 项长期未解的前沿数学难题,并提供了 Lean 证书。据称,寻找这些解法的推理成本不到 2000 美元。
- Anthropic 追击:不到 24 小时,Anthropic 研究员回应称,使用公开模型 Fable 在无网络、防泄漏的条件下,成功复现了其中 5 项证明。
深层意义:
- 首发保鲜期缩短:过去数学优先权之争以年计,如今 AI 模型的首发优势仅能维持数小时。
- 从刷榜到互验:两个模型独立推导出同一结论,类似于同行评审,验证了 AI 证明的可靠性。
- 验证成为瓶颈:随着 AI 批量生成前沿证明的能力增强,人类专家的验证能力正成为制约这项技术发展的核心瓶颈。
所属事件:Anthropic 员工称用 Fable 24 小时复现半数 Astra 证明(4 条相关)→
「模型」频道最新
- 零重训改造冻结 LLM:向浅层泄漏深层残差向量解状态追踪难题 — burny_tech · 2026-09-18
- Qwen3.8-Omni-Flash 发布:多人会议识别错误率降至 3%,API 降价 98% — karminski3 · 2026-09-18
- 内部人士:Gemini 3.8 live 部分基准已胜过 gpt-live-1 — bosmeny · 2026-09-18
- 105 个植入 bug 实测:Pareto 以 4.81 美元成本逼近顶级模型 — PawelHuryn · 2026-09-18
- Jason Wei 演讲:智能正商品化,自适应计算是关键转折 — dotey · 2026-09-18
- GPT-6-Astra 三小时通关《过山车大亨2》,对手花 5 倍 token 仍未达标 — scaling01 · 2026-09-18