OpenAI 与 Anthropic 前沿数学竞赛:Astra 领跑 24 小时被追平
新智元 · wechat · 2026-08-03
上周末,OpenAI 与 Anthropic 在前沿数学领域展开了一场激烈的 AI 竞赛。
事件脉络:
- OpenAI 发难:8 月 1 日,OpenAI 研究员宣布其未公开的下一代模型 Astra 成功证明了 10 项长期未解的前沿数学难题,并提供了 Lean 证书。据称,寻找这些解法的推理成本不到 2000 美元。
- Anthropic 追击:不到 24 小时,Anthropic 研究员回应称,使用公开模型 Fable 在无网络、防泄漏的条件下,成功复现了其中 5 项证明。
深层意义:
- 首发保鲜期缩短:过去数学优先权之争以年计,如今 AI 模型的首发优势仅能维持数小时。
- 从刷榜到互验:两个模型独立推导出同一结论,类似于同行评审,验证了 AI 证明的可靠性。
- 验证成为瓶颈:随着 AI 批量生成前沿证明的能力增强,人类专家的验证能力正成为制约这项技术发展的核心瓶颈。
所属事件:Anthropic 员工称用 Fable 24 小时复现半数 Astra 证明(4 条相关)→
「模型」频道最新
- Baseten 测试 Laguna S 2.1 改造 715 文件 C++ 游戏 — baseten · 2026-08-04
- Nous 联创称 Hermes Agent 的记忆和技能栈比底座模型更重要 — petergyang · 2026-08-04
- 发帖者称 DeepSeek 这次输出胜过 GPT-5.6 Sol — yacineMTB · 2026-08-04
- Kimi 和 GLM 5.2 定价继续下探,模型跨平台迁移加速 — markjeffrey · 2026-08-04
- OpenAI 揭秘:6 个月打造 GPT 实时低延迟语音系统 — borowcy · 2026-08-04
- 基准测试称前沿模型仍难正确实现基础 PDE 求解器 — GaryMarcus · 2026-08-04