Opus 5 多项基准领跑,覆盖编程搜索与推理

signulll · x · 2026-07-25

这张对比图把 Opus 5 和 Fable 5 / Opus 4.8 / GPT-5.6 Sol 放在一组覆盖编程、搜索、推理、工具使用、医疗和生物的基准上看,核心结论是:它不是单点提升,而是一次更全面的能力跃迁。

整张图传递的信息很明确:Opus 5 在多项通用能力上都处于第一梯队,尤其是在 agentic 工作流和综合任务上表现突出。

所属事件:Anthropic 发布 Claude Opus 5(40 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →