GLM-5.2 在 RTX 5090 上推理提速至 80–110 tok/s

markjeffrey · x · 2026-07-27

GLM-5.2 在 RTX 5090 上推理速度提升到原来的 3 倍

一条转述帖显示,Ning 把 GLM-5.2 在 RTX 5090 上的单路推理速度从大约 30 tok/s 提升到了 80–110 tok/s,相当于一夜之间快了约 3 倍。

这更像是一次面向本地推理的性能优化,而不是新模型发布本身。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →