GLM-5.2 权重减 423GB

EAccelerate_42 · x · 2026-07-13

作者称自己把 GLM-5.2 的体积在不改变模型的前提下减少了 423GB:

关键思路是:权重继续以压缩状态留在 VRAM 里,而不是先把完整模型重建出来。作者说完整写法和 repo 会在下一条发布。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →