Claude Opus 5 在 FrontierCode 上以中等算力拿到 53.4% 和 63.6%

andrew_n_carr · x · 2026-07-25

这张图展示了 Claude Opus 5 在 FrontierCode 上的测试时算力缩放表现,主集和扩展集都给出了不同 reasoning effort 下的分数。

这条帖子的核心意思是:Opus 5 是一个很强的编码模型,但最佳表现取决于给它多少推理预算。

所属事件:Anthropic 发布 Claude Opus 5,多项基准领先且价格减半(72 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →