Gary Marcus:AI 数学系统被曝未能解出部分可解题
GaryMarcus · x · 2026-08-02
Gary Marcus 对近期备受瞩目的 AI 数学推理系统提出进一步质疑。他指出,事实证明该系统在面对部分问题时实际上求解失败,而且其中一些问题本身其实是可解的。这表明当前模型在复杂推理任务上的能力仍被外界高估。
所属事件:OpenAI数学突破遭Gary Marcus等质疑炒作(38 条相关)→
「模型」频道最新
- 实测:印地语任务 Sarvam 比 Claude 快 58 倍 — itsOmSarraf_ · 2026-08-17
- 为 Qwen3.8-27B 辩护:推理 token 多不等于「过度思考」 — ResearchCrafty1804 · 2026-08-17
- 观点:OpenAI 重金囤算力,或在憋更强模型等基础设施就绪 — haider1 · 2026-08-17
- Grok 过度字面理解指令,竟列出图标名而非复用 — Daniel_Farinax · 2026-08-17
- 用户抱怨 ChatGPT 两周内明显变笨,指令转眼就忘 — Cubic_Inequality504 · 2026-08-17
- Mac Studio 上实测 DeepSeek V4 Flash:质量惊艳 — pj-frey · 2026-08-17