Claude Opus 5 在 ARC-AGI-3 评测中得分超次优模型三倍

claudeai · x · 2026-07-25

Anthropic 公布了 Claude Opus 5 在 ARC-AGI-3 基准测试中的表现。该测试主要用于评估 AI 模型解决新颖问题的能力,而 Opus 5 的得分是排名第二的模型的三倍,展现出极强的推理与泛化能力。

所属事件:Anthropic 发布 Claude Opus 5,性能达新 SOTA 且价格减半(25 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →