NOOA 加 GPT-5.6 系统在 ARC-AGI3 公测拿到 85.1%
JFPuget · x · 2026-07-27
这条帖子的重点是 ARC-AGI3 public games 的表现:配图显示,基于 NOOA + GPT-5.6-sol 的“world model + memory”方案拿到 85.1% 的 fleet-mean RHAE,明显高于 GPT-5.5 相关版本。
图里同时给出对比:
- NOOA + GPT-5.6-sol(world model + memory):85.1%
- NOOA + GPT-5.5(world model + memory):50.2%
- NOOA + GPT-5.5 baseline skill:41.7%
- NOOA + GPT-5.5 markdown files:38.4%
这是一条典型的模型/评测进展帖,核心信息是该团队在 ARC-AGI3 公共关卡上的显著提升。
所属事件:新智能体框架在 ARC-AGI3 测试获 85.1% 高分(4 条相关)→
「模型」频道最新
- Kimi K3 上线 Nebius,FP4 推理号称快 3 到 4 倍 — teortaxesTex · 2026-07-27
- 用户称 Opus-5 已接近日常主力模型 — adonis_singh · 2026-07-27
- Macaron V1 发布:748B 旗舰与 50B 本地部署双版本 — AdinaYakup · 2026-07-27
- 用户截图直言 ChatGPT 和 Kimi 已经写得比 Claude 更好 — heyshrutimishra · 2026-07-27
- Merge Fusion 称在各个价位都压过底层模型 — shensi · 2026-07-27
- Macaron V1 预览版推出 748B 旗舰和 50B 本地版 — AdinaYakup · 2026-07-27