新智能体框架在 ARC AGI3 公共测试拿到 85%
JFPuget · x · 2026-07-27
JFPuget 提到同事们做了一个新的 agent framework,他自己的团队也参与了一部分工作;同时,这个框架在 ARC AGI3 public games 上拿到了 85% 的成绩。
帖子很短,但信息点明确:一方面是新的智能体框架,另一方面是在 ARC 风格任务上给出了相当亮眼的公开成绩,说明这个系统已经展示出一定的实战能力。
所属事件:新智能体框架在 ARC-AGI3 公测取得 85.1% 成绩(5 条相关)→
「编程与Agent」频道最新
- Macaron-V1 基于 GLM-5.2 推出编码 checkpoint 和 1M 上下文 — kristoph · 2026-07-27
- Moonshot 发布 Kimi K3:2.8T 参数、100 万上下文、原生多模态 — mervenoyann · 2026-07-27
- 阿里·戈德西称智能体越“久炖”越差,关键是上下文组织 — jefrankle · 2026-07-27
- AIWayfinder 为智能体对话增加保存、浏览和重命名功能 — templecrash · 2026-07-27
- Hugging Face 模型卡披露 Kimi K3 的 2.8T 多模态配置 — op7418 · 2026-07-27
- Opus 5 代码审计实测:百万上下文与验证层构建 — socialwithaayan · 2026-07-27