专家24小时复现OpenAI数学成果,Astra被指非质变
Gary Marcus · rss · 2026-08-04
Gary Marcus 发文对 OpenAI 的 Astra 数学模型提出两点深度质疑:
- Astra 的突破可能被夸大:Anthropic 的数学家 Levent Alpöge 仅用 24 小时,就使用已开源的 Fable 模型成功复现了 OpenAI 一半的数学测试结果。这暗示 OpenAI 的核心进展可能不在于模型架构的质变,而是利用 AI 筛选出了适合“搜索与验证”技术的数学子集。此外,OpenAI 内部对 Astra 是命名为 GPT 6 还是 GPT 5.7 仍存疑,侧面反映其可能并非跨代际飞跃。
- 陶哲轩对 AI 数学能力的警示:顶尖数学家陶哲轩在近期讲座中提出了“证明消化不良”的概念,指出即使 AI 能生成大量正确的证明,也未必具备真正的数学价值。他强调,解决开放性问题与构建理论体系是两回事,目前没有证据表明 Astra 能胜任后者。
「模型」频道最新
- Databricks 称 Kimi K3 推理速度已达 239 tokens/s — Yuchenj_UW · 2026-08-04
- Claude Max 用户讨论要不要再配 Codex Pro 或 GLM 5.2 — tinker_20 · 2026-08-04
- 数学家验证 GPT Pro:零计算错误,但证明表述极差 — josh_wills · 2026-08-04
- 蚂蚁员工长文:中国 AI 大厂的四个截然不同的战略赌注 — AcanthisittaOk1699 · 2026-08-04
- 传 OpenAI 将发 Astra 模型,主打多智能体协同 — thesaraharminta · 2026-08-04
- 实测 Qwen3.8-Max:开源模型在 Agent 任务已逼近闭源前沿 — dair_ai · 2026-08-04