Opus 5.5 单任务耗 1560 万 token,比 Opus 5 多 37%
ArtificialAnlys · x · 2026-09-24
Artificial Analysis 上线了 Coding Agent 基准榜单,用 DeepSWE v1.1(113 个软件工程任务)、Terminal-Bench 4.0(66 个终端智能体任务)、SWE-Atlas-QnA(124 个技术问答任务)三项等权合成 Coding Agent Index,每项取三次尝试的 pass@1 平均,并同时给出每任务耗时与 API 成本。
榜单方同时披露:Claude Opus 5.5 每个任务消耗 15.6M token,比 Opus 5 的 11.4M 高出 37%;其中缓存输入从 10.9M 升到 14.6M,输出 token 则翻倍以上,从 137k 增至 333k。
所属事件:Opus 5.5 登顶编码智能体指数,但单任务 token 消耗与成本双升(5 条相关)→
「编程与Agent」频道最新
- 作者开源笔刷动画工作流:用 Claude 做出更高质量动画 — alejandroll10 · 2026-09-24
- Opus 5.5 纯代码搞定 Blender 建模绑定,作者封装成首个开发 skill — TAbrodi · 2026-09-24
- 一条 prompt 让 agent 自己核算账单:价格涨还是用量涨? — gethackteam · 2026-09-24
- Opus 5.5 单条 prompt 一次生成 C/C++ 版 90 年代 demoscene 演示 — dreamwieber · 2026-09-24
- 用 Sonnet 3.7 起步、Opus 5.5 重构:AI 生成 Rummy 500 游戏免费上线 — AIandDesign · 2026-09-24
- Garry Tan:创业公司获客正被 agent 双向重塑 — garrytan · 2026-09-24