两年前的 BABA-is-AI 论文仍能击穿 SOTA 模型,值得重测
moschles · reddit · 2026-10-09
2024 年 ICML 论文 BABA-is-AI(MIT 与 Virginia Tech 研究者)测试 GPT-4o、Gemini-1.5-Pro/Flash 发现:当任务需要操纵和组合游戏规则时,SOTA 多模态模型“惨败”。作者 moschles 提出疑问:如今万亿参数级 agentic swarm 已能攻克 ARC-AGI-3 和 FrontierMath tier 4,这些小型 key-door 谜题是否仍能让最强模型翻车?若答案是肯定的,这篇论文的重要性只增不减,应作为候选基准提交给 Chollet 与 ARC Foundation,纳入 ARC-AGI-4 考量。项目开源在 GitHub,论文编号 arXiv 2407.13729。
所属事件:两年前 BABA-is-AI 论文重提:SOTA 多模态模型仍惨败(2 条相关)→
「漫话AGI」频道最新
- 创业者放话:Anthropic 对人类的威胁大于潜在超级智能 — dbasch · 2026-10-09
- 创作者回击 AI 作品批评者:你们根本不懂用 AI 做出好东西的成本 — Uncanny_Harry · 2026-10-09
- 独立研究者发布 AI 加速相变模型,6 个预注册预测窗口全部命中 — sadeyeprophet · 2026-10-09
- AI 冲击数学界引激烈论战,牛津学者整理「AI 与数学」必读清单 — StefanoGogioso · 2026-10-09
- Yudkowsky:AGI 到「末日」时投入可能还不如一座台积电晶圆厂 — panickssery · 2026-10-09
- AI 投资人:一切行业都可拆成 8 个原语,机会是全 GDP — signulll · 2026-10-09