Gary Marcus 炮轰 OpenAI 数学突破报告:换未发布模型、零细节,过不了同行评审
Gary Marcus · rss · 2026-10-08
Gary Marcus 撰文评论 OpenAI 的重磅数学成果,称「真正的新闻不是结果本身,也不是我们被告知的那样」。
他的核心批评:
- OpenAI 的报告极度模糊——「同样的流程」「使用未发布模型」这类表述永远过不了同行评审
- 关键信息全部缺失:证明是一次生成后由 Lean 验证,还是迭代过程?架构未知,失败率未知,训练/后训练/数据增强一概不知
- 因此完全无法判断结果在数学之外的可泛化性——可能是通向 AGI 的真正一步,也可能只是 Lean+合成数据在可验证领域的巧妙利用,毫无泛化性
- 社媒讨论已沦为「无知的欢呼」,没人问基本科学问题
文末附 Terence Tao 的互补观点(订阅可见)。
「模型」频道最新
- 曝 Anthropic 即将发布 Claude Haiku 5.5,输入价格低至 $0.1/M tokens — kimmonismus · 2026-10-08
- Anthropic Haiku 5.5 发布日,网友简讯式庆祝 — scaling01 · 2026-10-08
- Claude Code 更新惊现 claude-haiku-5-5 字符串 — lyraxana · 2026-10-08
- ThePrimeagen 实测 OpenAI 新决策模型:更快更准 — prd_008 · 2026-10-08
- Liquid AI 开源发布 d1 决策模型:d1-3B 登顶 10B 以下决策基准 — RespectJaded15 · 2026-10-08
- AI2 Bolmo 分词器消除全球南方文字的「token 税」 — Kyle_L_Wiggers · 2026-10-08