两年前 BABA-is-AI 论文重提:SOTA 多模态模型仍惨败

Reddit 用户翻出 2024 年 ICML 论文《BABA-is-AI》,该研究由 MIT 与 Virginia Tech 研究者完成,测试 GPT-4o、Gemini-1.5-Pro/Flash 等模型后发现:当任务需要操纵共享字母等特定操作时,多款 SOTA 多模态模型表现惨淡。两年后该论文重新引发讨论,有观点认为其测试方法值得在更新的模型上重测,以检验当前前沿模型是否已克服这类缺陷。

2026-10-09 ~ 2026-10-09 · 2 条相关

另有 1 条近重复转述:moschles