18 个月智能-成本前沿巨变:从 GPT-5 mini 17 分到 Opus 5.5 拿下 58 分
ArtificialAnlys · x · 2026-09-30
Artificial Analysis 发布其智能指数与单任务成本帕累托前沿的 18 个月对比:
- 一年前榜单最高分是 GPT-5 mini (high),在 v4.3 智能指数上得 17 分,单任务成本约 $0.05。
- 上周 Claude Opus 5.5 创下迄今最高分 58,单任务成本约 $5.98。
- 也就是说,顶级智能得分一年多涨了约 2.4 倍,但成本涨了约 120 倍——智能与成本的前沿位置发生了剧烈移动。
该指数 v4.3 版本用 AutomationBench-AA 替换了 𝜏³-Banking,并将 Terminal-Bench 升级到 4.0。
「Infra」频道最新
- Raja Koduri:西方每吉瓦 AI 算力花 500-600 亿美元,中国目标不到 100 亿 — RajaXg · 2026-09-30
- DeepGEMM 移植华为昇腾并开源:GEMM 达硬件上限 99.8% — zheanxu · 2026-09-30
- Google Project Suncatcher 首次将 TPU 送入太空,10 月 1 日随火箭升空 — allisondman · 2026-09-30
- Photon 2.6 发布:FP8+投机解码,B200 上 Qwen3.5 27B 跑出 400 tok/s — Bedrovelsen · 2026-09-30
- SGLang 把 Qwen3.8-27B 变决策模型,百毫秒内通关宝可梦火红 — zhaoran_wang · 2026-09-30
- Agent 时代 CPU 成新瓶颈:Vera 单独部署预示 CPU:GPU 比例将上调 — AccBalanced · 2026-09-30