Claude Opus 4.6 概念版跑分曝光:ARC-AGI-3 解题能力超越 Gemini 3.1 Pro

scaling01 · x · 2026-08-07

有博主分享了关于 ARC-AGI-3 基准测试的最新观察文章。文章指出,假设的 Claude Opus 4.6 在推理和记忆使用上表现优于 Gemini 3.1 Pro,能够解开更多测试关卡。作者因此对当前及未来模型解决 ARC-AGI-3 的能力抱有高度信心。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →