新 agent 框架在 ARC AGI3 公测拿到 85.1%
JFPuget · x · 2026-07-27
帖子配图展示了一个新的 agent framework 在 ARC AGI3 public games 上的结果,最高达到 85.1%。
- 图中对比了几条曲线:
- NOOA + GPT-5.6-sol(world model + memory):最终约 85.1%
- NOOA + GPT-5.5(world model + memory):约 50.2%
- NOOA + GPT-5.5(baseline skill):约 41.7%
- NOOA + GPT-5.5(markdown files):约 38.4%
- 发帖者称这项工作由 Elad Sarafian 和 Gal Kaplun 完成,自己团队也有少量贡献。
所属事件:新型智能体框架在 ARC-AGI3 公测中取得 85% 成绩(3 条相关)→
「编程与Agent」频道最新
- Google Cloud Model Armor 直指多智能体 prompt 注入与泄露 — Pavan_Belagatti · 2026-07-27
- GBrain 称 Top-5 召回里纯向量检索已接近混合方案 — garrytan · 2026-07-27
- Codex 被吐槽把 8 个并行任务串成 8 小时循环 — chaumian · 2026-07-27
- 缓存输入让循环式智能体工作流更省钱 — yunta_tsai · 2026-07-27
- GitLord 把每步 agent 变成 Git 提交,公开征集 V2 功能 — Square_Light1441 · 2026-07-27
- 一个统一调试工作台想解决多步 AI 工作流排障 — No_Twist_6124 · 2026-07-27