ARC-AGI-3 社区分数大幅领先
GregKamradt · x · 2026-07-16
这条帖在推荐一项关于 ARC-AGI-3 的研究。
引用内容给出的核心结果是:某社区方案在 25 个公开游戏 中拿到 78.4% 的总分,完成 160/183 个关卡;而当前最佳前沿 LLM 的单次会话得分只有 7.8%。同时还强调这个成绩 不允许训练或示范。
原帖还附了论文和博客链接,说明这不是单纯的榜单成绩,而是围绕 ARC-AGI-3 的方法与评测讨论。
所属事件:Schema harness 引爆 ARC-AGI-3 讨论(14 条相关)→
「漫话AGI」频道最新
- Sam Altman 在 G20 放话:三个月创业工作现在 17 分钟搞定 — rohanpaul_ai · 2026-09-03
- Greg Brockman:ChatGPT 的终点是「个人 AGI」 — ChrisGPT · 2026-09-03
- 申真谞让二子 2-1 逆转 KataGo,创人类对 AI 正式赛首胜 — chrisalbon · 2026-09-03
- 从 42 小时到不足 1 秒:照明成本暴跌见证技术威力 — PeterDiamandis · 2026-09-03
- 网友断言:浏览器 Agent 能力现在是有史以来最差时刻 — manosaie · 2026-09-03
- Nathan Young 警告:智能体零日漏洞能力半年内或进入中国开源模型 — NathanpmYoung · 2026-09-03