Claude Opus 5 在代码智能体基准拿到 67 分

Hesamation · x · 2026-07-25

这条转发配图是一张 Artificial Analysis Coding Agent 排行图,比较了多个模型在 DeepSWE、Terminal-Bench v2、SWE-Atlas-QnA 上的综合 pass@1。图中 Claude Opus 5 (xhigh) 以 67 分位居第一/并列第一,发帖者也直接评价 Anthropic 这次“做得很强”。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →