Claude Opus 5 在 ARC-AGI-3 上拿到 30.2%

The Decoder · rss · 2026-07-26

The Decoder 报道称,Anthropic 的 Claude Opus 5 在 ARC-AGI-3 上拿到 30.2%,接近把此前 GPT-5.6 Sol 的 7.8% 纪录翻了四倍。这个基准被设计用来衡量更接近“通用智能”的能力。

基准开发者还表示,这个模型自主推导出了 reflection equations,这是他们此前没在其他模型身上见过的行为,因此他们把这视作更强逻辑推理能力的迹象。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →