Artificial Analysis 数据:max 推理档位成本近翻倍,智能提升却微乎其微
randal_olson · x · 2026-10-07
Randal Olson 基于 Artificial Analysis 10月6日快照数据指出:把推理档位调到 max 几乎让单任务成本翻倍,但 Intelligence Index 提升极小。Claude Opus 5.5 在 xhigh 档(约 $3.46/任务,智能分 56)大致追平 Sonnet 5.5 的 max 档($7.67/任务,56),成本却不到一半。各模型成本/智能分对比:Opus 5.5 max $5.98(58)、Sonnet 5.5 max $7.67(56)、Opus xhigh $3.46(56)、Opus high $1.82(54)。结论:切到 max 前先横向比价。图表用其开源的 evident-charts skill 生成。
所属事件:max 推理档位成本近翻倍,智能提升微乎其微(2 条相关)→
「模型」频道最新
- Mistral Large 4 临床决策评测并列第一,零严重失误 — GuillaumeLample · 2026-10-07
- 五年前 OpenAI 发布小学数学题集,当时所有 AI 都做不好 — 1a3orn · 2026-10-07
- OpenAI Decisions API 支持图像输入,13 美分挑出 40 分钟素材最佳表情 — stevenheidel · 2026-10-07
- 回想 2023 年 GPT-4 连小学应用题都会做错 — tszzl · 2026-10-07
- 网友称 HPIM 训练未用吉瓦级算力,「怪异区」已开启 — teortaxesTex · 2026-10-07
- OpenAI 安全人员自述:内部模型解决 Navier-Stokes「完全超出预期」 — i_dg23 · 2026-10-07