AA 实测:Claude Sonnet 5.5 单任务烧 19.3 万输出 token,是 GPT-6 Astra 的 7 倍
ArtificialAnlys · x · 2026-09-29
Artificial Analysis 测量发现,Claude Sonnet 5.5(max effort)在每道 Intelligence Index 任务上平均消耗约 19.3 万输出 token,是所有已测模型中最高的,约为 GPT-6 Astra(max)的 7 倍——用超大推理量换来了顶尖表现。
但在更低 effort 档位上,性价比劣势明显:low/medium/high 三档在「智能 vs 单任务输出 token」的权衡曲线上,分别落后于 GPT-6 Sol 的 high、xhigh、max 档,即同档推理预算下 Sol 能用更少 token 达到更高性能。
所属事件:AA 评测 Sonnet 5.5:性能逼近旗舰,token 消耗最高(8 条相关)→
「模型」频道最新
- OpenAI 与 Anthropic 模型对决前瞻:6.1 Astra 明日或迎关键一战 — karmay007 · 2026-09-29
- 曝 OpenAI 开发者日或发布「守护者」类新功能 — imjustnewatai · 2026-09-29
- 开发者实测:Claude 新模型话痨程度介于 Opus 与 Sonnet 5 之间 — felixrieseberg · 2026-09-29
- naiveailab 新模型以小米 MiMo-V2.5 为底座,开源生态成堆叠起点 — teortaxesTex · 2026-09-29
- Sentdex:本地跑了 40 亿 token,GLM 5.3 Flash 成其最常用本地模型 — Sentdex · 2026-09-29
- 网传截图:Sonnet-5.5 评测分超 Astra,作者称难辨真伪 — adonis_singh · 2026-09-29