Opus 5.5 登顶 AA 榜 58 分,代价比 Astra 便宜 60% 但吃 token 更凶

johnseach · x · 2026-09-23

Anthropic 发布 Claude Opus 5.5,与三周前亮相的 OpenAI GPT-6 Astra 正面对撞:同为 1M 级上下文、128K 输出上限,但押注方向截然不同。

综合评测:在 Artificial Analysis Intelligence Index 上,Opus 5.5 以 58 分登顶第一,Astra 与 Fable 5.1 同为 53,旧 Opus 5 为 51。Opus 在十项测试中领跑六项,优势最大的是知识型工作与长程 agent 任务。

价格:Opus 5.5 为 $4/$20(输入/输出每百万 token),Astra 为 $10/$50;缓存读取 $0.20 对 $1.00——Opus token 便宜约 60%、缓存便宜 5 倍。但 Astra 更省 token:同一测试下每任务约 27k 对 Opus 的 119k,实际账单差距比标价小。

编码:两家各自发布自家有利的表格(Anthropic 称 Opus 66.4% vs 57.9% on Terminal-Bench 4.0),同一 harness 下的独立测试显示两者约打平(59-60%)。作者提醒:厂商图表总是偏袒自家。

各自强项:

结论:这周只选一个日常主力就用 Opus 5.5——更便宜、长 agent 与知识工作更强;Astra 留给前沿数学、终端科学任务、重屏幕的计算机使用和(被门控的)网络攻防。

所属事件:Opus 5.5 发布即登顶智能指数,降价提速碾压 GPT-6(50 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →