Artificial Analysis 把模型智能和成本比投上旧金山广告牌
ArtificialAnlys · x · 2026-07-24
Artificial Analysis 说,他们已经在旧金山投放广告牌,展示最新的 “智能指数 vs. 单次任务成本” 图表,用来比较当下主流模型的性价比。
- 他们认为,成本效率正在成为模型评估的核心维度。
- 图中 Fable 5 的 Intelligence Index 最高,达到 60,但平均 每次任务 $2.75。
- Grok 4.5 (high) 的分数是 54,单次任务 $0.31,大约便宜 9 倍,并被放在 Pareto frontier 上。
- DeepSeek v4 Flash 的分数为 44,单次任务 $0.04,相较 Fable 便宜约 69 倍。
- 他们对 Pareto frontier 的定义是:在智能水平和成本两个维度上,都没有被其他模型同时超越的模型。
所属事件:Artificial Analysis 登陆旧金山街头广告牌(2 条相关)→
「Infra」频道最新
- Baseten 推出 GLM-5.2 Fast,实时场景 TPS 提升 2-3 倍 — baseten · 2026-07-24
- Anthropic 似乎在转录中用 Deepgram,但未列入子处理方 — tokenbender · 2026-07-24
- 英特尔财报超预期股价大涨 11%,AI 需求成关键动力 — econoar · 2026-07-24
- 北弗吉尼亚数据中心骤降 3GW 负载冲击 PJM 电网 — Annual_Judge_7272 · 2026-07-24
- AMD Helios 很强,但和 Vera Rubin 不是同口径对比 — karlfreund · 2026-07-24
- NVIDIA Vera Rubin NVL72 集群实拍:72 块 GPU 塞进一机柜 — rohanpaul_ai · 2026-07-24