Artificial Analysis 把模型智能和成本比投上旧金山广告牌
ArtificialAnlys · x · 2026-07-24
Artificial Analysis 说,他们已经在旧金山投放广告牌,展示最新的 “智能指数 vs. 单次任务成本” 图表,用来比较当下主流模型的性价比。
- 他们认为,成本效率正在成为模型评估的核心维度。
- 图中 Fable 5 的 Intelligence Index 最高,达到 60,但平均 每次任务 $2.75。
- Grok 4.5 (high) 的分数是 54,单次任务 $0.31,大约便宜 9 倍,并被放在 Pareto frontier 上。
- DeepSeek v4 Flash 的分数为 44,单次任务 $0.04,相较 Fable 便宜约 69 倍。
- 他们对 Pareto frontier 的定义是:在智能水平和成本两个维度上,都没有被其他模型同时超越的模型。
所属事件:Artificial Analysis 登陆旧金山街头广告牌(2 条相关)→
「Infra」频道最新
- 劝退帖:推理工程是真金白银的硬活,八成尝鲜者已悄然放弃 — abhijithneil · 2026-09-11
- Hugging Face《Ultra Scale Playbook》:GPU 集群训练 LLM 的免费技术书 — mdancho84 · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11
- 7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据 — thenomadexplorerlife · 2026-09-11