重绘 GLM-5.3 等模型智价比图表,引入本地算力成本
crusaderky · reddit · 2026-08-19
作者批评 Artificial Analysis (AA) 的智/费图表误导(尤其是对数坐标掩盖真实成本),重新绘制了线性坐标版本。新图表纳入了 GLM-5.3、DeepSeek V4 Flash 和 Qwen3.8-27B(基于 RTX 3090 的本地推演电费成本)。作者指出,对于普通用户,本地部署 Qwen 与 API 调用 DeepSeek 的成本差异微乎其微,但若升级至 128GB RAM 等专用硬件,自托管成本分析则变得复杂且不再具备优势。
「Infra」频道最新
- 机器人仿真被视为最清洁的创新激励系统 — const_reborn · 2026-08-19
- 网友询问各订阅服务的 Token 补贴现状,求可靠对比 — mitsuhiko · 2026-08-19
- Meta 发布 Muse Glimmer:30B 本地语音 agent 实现低延迟推理 — Once_ina_Lifetime · 2026-08-19
- Gortex 引擎:基于图索引降低 50% Token 消耗 — tom_doerr · 2026-08-19
- Nvidia GPU 利用率误导大?A100 实测指令发射率不足一半 — tokenbender · 2026-08-19
- Marvell 授予 Google 认股权证,深度绑定定制芯片业务 — zephyr_z9 · 2026-08-19