Opus 5.5 多数基准领先 GPT-6 Astra,科学终端基准仍落后

BenBlaiszik · x · 2026-09-23

Anthropic 官方宣布 Opus 5.5 相比 Opus 5 是重大跃升,在 agentic coding、computer use 和知识工作三方面领先。第三方对比显示,Opus 5.5 在多数基准上超过 Fable 5.1 和 GPT-6 Astra,但 GPT-6 Astra 在 Terminal-Bench-Science 上仍明显领先,发帖人就此征求社区对差距原因的假说。

所属事件:Claude Opus 5.5 登顶 AA 智能指数并降价约 20%(78 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →