Gary Marcus 评 GPT-6 Astra:符号世界模型获正名,但离 AGI 还远
Gary Marcus · rss · 2026-09-04
Gary Marcus 针对 OpenAI 新模型 GPT-6 Astra 发表初步评论:
- ARC-AGI 表现:ARC Prize 官方数据显示,Astra 在 ARC-AGI-3 上得 63%,经新的 provider adapter harness 可达 99%,在 96% 的关卡上超越人类表现,并构建了迄今最精确的新环境符号模型。
- 观点立场:Marcus 十年来一直倡导(神经)符号世界模型,看到 OpenAI 产品明确创建并操纵符号世界模型,他感到「极其正名」。
- 保留意见:关键问题是该能力的鲁棒性;ARC-AGI 成功不等于 AGI,他预计在开放式现实世界任务上会暴露大量问题,最强表现可能在可验证领域。
- 批评点:系统内部机制不透明(科学家无法了解原理);与以往相比可监控性更差但「更可对齐」原因不明,从安全角度看能力更强+可监控性更差并非好事;支持者提前拿到模型而怀疑者没有,这种营销策略历史上往往导致热度被逐步修正。
- 他还提出挑战 Greg Brockman 的 AGI 宣称,并希望看 Astra 能否在其与 Miles Brundage 2024 年底设下的十个赌约任务上取得进展——目前没有任何 AI 在其中任何一项上成功。
「漫话AGI」频道最新
- AI 圈知名研究者喊话:真正懂模型能力的人极少,快去动手探索 — CatAstro_Piyush · 2026-09-04
- 网友热议:AI 时代利大于弊,个人 JARVIS 助理人人可享 — youngwooki23 · 2026-09-04
- 胡佛研究所复盘:生成式 AI 最初几年的失业恐慌是否成真 — HooverInstitution · 2026-09-04
- 约1200个智能体自组织成群,连续数日协作执行网络攻击 — scaling01 · 2026-09-04
- WSJ 称检测 AI 意识有危险,研究者反驳不查才更危险 — PeterBowdenLive · 2026-09-04
- 传 GPT-6 Astra 心算竞赛级数学,隐式推理能力大幅跃升 — nabeelqu · 2026-09-04