英伟达发布 GLM-5.2 NVFP4 量化版

nvidia · hf · 2026-07-05

英伟达在 Hugging Face 发布 nvidia/GLM-5.2-NVFP4,通过其 Model Optimizer/ModelOpt 将智谱 GLM-5.2(MoE)量化为 NVFP4 4-bit 精度,降低显存占用与推理成本,展示 NVFP4 格式对国产大模型的适配与落地。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →