AI学者质疑 ARC-AGI 评测含金量,称评估模型时已很少参考其得分
arankomatsuzaki · x · 2026-08-06
AI 研究者 Aran Komatsuzaki 在 X 上参与讨论时,对 François Chollet 提出的 ARC-AGI 基准测试提出了质疑。他虽然认可 Keras 框架早期的贡献,但表示对 Chollet 近年来的工作(如 ARC-AGI)并不信服。
他明确指出,目前自己在评估新发布的大模型能力时,已经基本不怎么看重 ARC-AGI 的测试分数了。
所属事件:AI学者质疑ARC-AGI基准含金量,Keras创始人回应(2 条相关)→
「模型」频道最新
- MiniMax H3 登顶三大视频生成榜单,超越字节与谷歌 — petewoodbridge · 2026-08-06
- GPT-5.6 登顶 FutureSim 预测智能体榜单 — maksym_andr · 2026-08-06
- AI横扫五大国际奥赛:物理理论满分夺金 — shuchaobi · 2026-08-06
- ARC-AGI 3 被攻破,Jeff Dean 疑似离开谷歌 — altryne · 2026-08-06
- ThursdAI 直播:ARC-AGI 3 被攻克,Jeff Dean 离开 Google,多款模型发布 — WolframRvnwlf · 2026-08-06
- DeepSeek被曝成本并不低,低价或为策略性补贴 — DanielLockyer · 2026-08-06