OpenAI数学突破遭Gary Marcus等质疑炒作
OpenAI高管Noam Brown宣称其内部模型Astra解决了10个超过十年未解的数学与计算机科学难题,生成证明的API调用成本不到2000美元,并发布了249页论文。然而,该成果随即遭到以Gary Marcus为代表的学术界广泛质疑,被批评缺乏科学透明度且实际价值被过度炒作。当前结论认为,数学领域的专精突破并不等同于实现了AGI,模型的真实推理能力与具体成本细节尚待同行评议验证。
已确认
- OpenAI发布了249页论文,宣称模型在解决10个数学难题上取得突破,API成本不到2000美元。
- 外界批评集中于科学透明度缺失与实际价值夸大。
尚未确认
- 模型解决难题的真实能力与含金量。作者@sudoraohacker强调现有模型推理能力有限,结果在同行评议前不能轻信。
- 实验具体成本与细节。HN社区指出官方未披露模型尝试次数,怀疑2000美元成本具有误导性,认为表面成本掩盖了实现这些能力的巨大资源投入。
- 至少一个AI数学证明可能有误。Gary Marcus指出,当有数学博士生提出反例指出证明可能存在错误时,这种严谨质疑却几乎无人问津。此外,该系统在面对部分实际可解的问题时也出现了求解失败的情况。
为什么重要
- 科学透明度争议:Gary Marcus直言论文未披露模型工作原理、验证过程、人类角色及证明错误等核心细节,质问“科学精神去哪了”。学者Pedro Domingos也批评这种隐瞒方法的做法无助于AI领域的技术进步。AI研究者Itaisher也呼吁行业应公开模型尝试过的所有问题集合,避免只报喜。
- 开放领域推理能力受疑:多位观点指出,AI展现的解题能力并非源于概念上的理论创新或真正的数学直觉,而是依靠庞大算力驱动的高级模式匹配。Gary Marcus强调,解决形式化问题不等于搞定开放性问题,突破并未创造新理论,并不意味着数学被彻底攻克。他进一步指出,数学基准测试自带验证器和合成数据,存在天然的“作弊机制”,这种特定领域的数据增强绝不等同于实现了AGI。此外,比起单纯的跑分成绩,业界亟需深究实现这些突破的具体工程过程与后训练方法。
- 基准测试可信度危机:Gary Marcus引用arXiv论文指出,当前AI Agent基准测试存在漏洞(如BenchJack审计工具所揭示的问题),认为近期关于模型进展的恐慌情绪是缺乏对照组的“耸人听闻”。
2026-08-01 ~ 2026-08-03 · 38 条相关
- 第 1 集:OpenAI测试多智能体模型Astra,已向美政府演示(2026-08-01,17 条)
- 第 2 集:OpenAI内部模型Astra连破10大数学难题(2026-08-01,99 条)
- 第 3 集:谷歌Astra模型以不到两千美元攻克十大科学难题(2026-08-01,4 条)
- 第 4 集:OpenAI数学突破遭Gary Marcus等质疑炒作(2026-08-01,38 条)
- 第 5 集:传 OpenAI 将发 Astra 模型主打多智能体协同(2026-08-02,3 条)
- 第 6 集:Anthropic 员工称用 Fable 24 小时复现半数 Astra 证明(2026-08-02,4 条)
- 第 7 集:提示距离:弱模型能否复现前沿证明(2026-08-03,6 条)
- 第 8 集:OpenAI称内部模型2000美元解决10项数学难题引争议(2026-08-03,15 条)
- 第 9 集:OpenAI公开Astra数学证明与推演手稿(2026-08-04,4 条)
- 第 10 集:传OpenAI下周发布Astra模型,或为GPT-4.5后最大预训练(2026-08-06,10 条)
- 第 11 集:OpenAI因网络安全风险放缓Astra开发并受限发布(2026-08-08,30 条)
- 第 12 集:OpenAI预告下一代模型Astra为首个网安关键模型(2026-08-08,4 条)
- 第 13 集:OpenAI新模型Astra或8月发布,10T参数引期待(2026-08-09,6 条)
- 第 14 集:OpenAI新模型代号Doug曝光,年底启动史上最大预训练(2026-08-09,8 条)
- 第 15 集:OpenAI 因网络攻击风险暂停 Astra 模型开发(2026-08-10,3 条)
- 第 16 集:OpenAI模型安全评级引争议(2026-08-11,2 条)
- 第 17 集:预测市场押注Astra下月发布概率76%(2026-08-14,2 条)
- 第 18 集:OpenAI 下一代模型 Astra 传闻升温,月底发布或本周四亮相(2026-08-15,5 条)
- 第 19 集:电力瓶颈威胁美国 AI 数据中心扩张(2026-08-17,4 条)
- 第 20 集:OpenAI 因模型越权与安全阈值暂停 Astra 前沿训练(2026-08-17,17 条)
一手来源
- Gary Marcus 炮轰 OpenAI 数学论文:只秀结果不谈验证 — GaryMarcus ·
- OpenAI解决十年数学难题,API成本仅两千美元引争议 — andersonbcdefg ·
- 曝 OpenAI 内部模型 Astra 解决 10 大数学难题,遭学者强烈抵制 — zetalyrae ·
- OpenAI 数学突破遭质疑:HN 社区吐槽实验缺乏透明度 — antirez · 2026-08-01
- Gary Marcus 推测谷歌 Astra 为神经符号架构 — GaryMarcus · 2026-08-01
- 【源头】Gary Marcus 炮轰 OpenAI 数学论文:只秀结果不谈验证 — GaryMarcus · 2026-08-01
- Gary Marcus 质疑 OpenAI 模型数学能力 — GaryMarcus · 2026-08-02
- Gary Marcus:纯LLM本质仍是随机鹦鹉,Astra证明需引入神经符号计算 — GaryMarcus · 2026-08-02
- Gary Marcus 批驳 Astra 泛化论:数学能力不代表能解决所有现实问题 — GaryMarcus · 2026-08-02
- OpenAI 新模型 Astra 传解开 10 大数学难题,遭质疑 — sudoraohacker · 2026-08-02
- OpenAI 数学成果被指缺乏透明度,未公开验证细节 — geoffwolfe · 2026-08-02
- Gary Marcus 批 AI 数学突破被夸大:缺乏真正新理论 — GaryMarcus · 2026-08-02
- Gary Marcus质疑OpenAI:至少一个AI数学证明有误 — GaryMarcus · 2026-08-02
- 【源头】OpenAI解决十年数学难题,API成本仅两千美元引争议 — andersonbcdefg · 2026-08-02
- Gary Marcus 转发探讨:AI 数学突破实为算力搜索而非直觉 — GaryMarcus · 2026-08-02
- Gary Marcus 质疑 OpenAI o1 数学证明被过度炒作 — GaryMarcus · 2026-08-02
- Gary Marcus 炮轰 AI 圈:别再盲目吹捧 Astra 是 ASI 了 — GaryMarcus · 2026-08-02
- Gary Marcus 怼 ASI 信仰:没有实质证据绝不低头 — GaryMarcus · 2026-08-02
- Gary Marcus 反驳「AI 已解决数学」论调 — GaryMarcus · 2026-08-02
- Gary Marcus:解决形式化问题不等于搞定开放性问题 — GaryMarcus · 2026-08-02
- Gary Marcus:AI 数学系统被曝未能解出部分可解题 — GaryMarcus · 2026-08-02
- 哥大教授:AI 解出证明与向专家讲清逻辑是两码事 — GaryMarcus · 2026-08-02
- 学者批隐瞒方法发 AI 证明:利数学却阻碍 AI 发展 — pmddomingos · 2026-08-02
- Gary Marcus:单一领域突破不等于AGI,警惕认知等同谬误 — GaryMarcus · 2026-08-02
- Gary Marcus回击OpenAI员工:Astra很强但绝非ASI — GaryMarcus · 2026-08-02
- Gary Marcus 辩论 AGI 定义:数学强不等于通用人工智能 — GaryMarcus · 2026-08-02
- Gary Marcus 嘲讽 AGI 定义之争:现在又想要它“通用”了? — GaryMarcus · 2026-08-02
- 学者评 OpenAI 数学突破:进展神速,但勿过度炒作 — soumitrashukla9 · 2026-08-02
- 学者呼吁AI数学评测应公开全部尝试,避免只报喜 — rbhar90 · 2026-08-02
- Gary Marcus:OpenAI 的进步是特定领域数据增强而非 AGI — GaryMarcus · 2026-08-02
- Gary Marcus 呼吁深究模型能力突破背后的工程细节 — GaryMarcus · 2026-08-02
- Gary Marcus 坚称:数学能力不代表 AI 实现全面通用智能 — GaryMarcus · 2026-08-03
- Gary Marcus:数学基准测试存在天然作弊漏洞 — GaryMarcus · 2026-08-03
- Gary Marcus 嘲讽 Astra 模型:并非超越 Sol 的质变 — GaryMarcus · 2026-08-03
- Gary Marcus 炮轰 OpenAI:研究竟无对照组 — GaryMarcus · 2026-08-03
- Gary Marcus 批 AI 末日论缺乏实证,引论文揭示 Agent 基准测试漏洞 — GaryMarcus · 2026-08-03
- Gary Marcus:Astra 只是渐进式改进,并非 AGI 革命 — GaryMarcus · 2026-08-03
- 曝 OpenAI 内部版 Astra 解决十大数学难题,但 LLM 仍无法实现认知跳跃 — ValerioCapraro · 2026-08-03
另有 3 条近重复转述:zetalyrae · GaryMarcus · GaryMarcus