GLM 上线后又开始试 8×H100 跑 DSv4 Flash

TheZachMueller · x · 2026-07-22

GLM 上线后,作者开始折腾 8×H100 部署 DSv4 Flash

原帖说,GLM 已经部署完成,而且速度“还不错”,接下来准备在 8 张 H100 上继续部署 DSv4 Flash,看看还能把速度榨到什么程度。

帖子还点出了准备尝试的并行与推理配置:DP4、EP8、TP2,以及 FP8 KV。这更像是一条关于 模型服务与推理栈调优 的实战记录,而不是模型本身的发布。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →