本地运行 SOTA 模型需十万级算力成本
kimmonismus · x · 2026-08-28
评论指出,若想在本地运行 FP8 精度的 SOTA 模型,大约需要 10-12 张 H100 显卡,成本在 40 万至 65 万美元之间。这展示了目前顶级开源模型在本地部署时面临的昂贵硬件门槛。
所属事件:智谱GLM-5.3确定8月28日开放权重发布(9 条相关)→
「Infra」频道最新
- GLM-5.3-Flash 推出 DFlash2 草稿模型,块扩散投机解码 — TheZachMueller · 2026-08-28
- GLM-5.3 Flash 搭配 DFlash2 推理速度大幅提升 — No_Afternoon_4260 · 2026-08-28
- AI 需求引爆 MLCC 市场,中国“电子大米”厂商利润大涨 — pstAsiatech · 2026-08-28
- 算力需求烧穿预算,MiniMax 将阿里云采购上限提 220% — pstAsiatech · 2026-08-28
- SP1 证明器 Metal 移植版性能提升最高 5.75 倍 — StefanoGogioso · 2026-08-28
- 开源 Open edX 的 MCP 服务器,支持自然语言管理课程 — Ornery_Landscape6715 · 2026-08-28