Opus 5.5 单任务耗 1560 万 token,比 Opus 5 多 37%

ArtificialAnlys · x · 2026-09-24

Artificial Analysis 上线了 Coding Agent 基准榜单,用 DeepSWE v1.1(113 个软件工程任务)、Terminal-Bench 4.0(66 个终端智能体任务)、SWE-Atlas-QnA(124 个技术问答任务)三项等权合成 Coding Agent Index,每项取三次尝试的 pass@1 平均,并同时给出每任务耗时与 API 成本。

榜单方同时披露:Claude Opus 5.5 每个任务消耗 15.6M token,比 Opus 5 的 11.4M 高出 37%;其中缓存输入从 10.9M 升到 14.6M,输出 token 则翻倍以上,从 137k 增至 333k。

所属事件:Opus 5.5 登顶编码智能体指数,但单任务 token 消耗与成本双升(5 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →