ARC-AGI-3 跑出 95.5% 高分,通用编码框架超越人类专家

thomasahle · x · 2026-08-06

PrimeIntellect 宣布其通用编码框架 Prime Agent 在 ARC-AGI-3 测试中取得了 95.5% 的高分,超越了人类专家的基线。该框架并非针对特定基准测试进行训练,而是通过简单的抽象设计,让任何底层大模型都能即插即用。相比各家模型自带的专有框架,Prime Agent 凭借这些抽象设计更好地激发了模型的原始能力,在多项测试中表现更优。

所属事件:PrimeIntellect开源Prime Agent,ARC-AGI-3得分95.5%超人类(40 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →