实测调优:双 GB10 双轨互联跑 GLM-5.3-Flash,吞吐提升约 20%

EAccelerate_42 · x · 2026-09-26

EAccelerate42 在 2×GB10 集群(ASUS GX10 + DGX Spark,双 ConnectX-7 轨道)上对 MiaAI-Lab 的 GLM-5.3-Flash EXL3 方案做了调优并开源成 recipe 仓库,权重不变、输出质量不变:

配置要点:TP=2,双轨 MTU 9000,驱动 580.173.02,测试用唯一 salt 冷 prompt、thinking 关闭、temp 0 取中位数。仓库(egl-accelerate/glm53-flash-2x-recipe)包含补丁、启动脚本、adaptivek 配置和每项选择的实测依据,EXL3 4bpw 下支持 850k 上下文。是一个可直接复现的双机部署配方。

所属事件:双 GB10 集群调优 GLM-5.3-Flash:预填充提速 20%(5 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →