本地跑 1 亿 token 的 GLM 5.2 只花 1 美元

_akhaliq · x · 2026-07-27

在本地用 GLM 5.2 NVFP4 跑了 1 亿多 token,电费只要大约 1 美元。

配图里的成本面板显示总费用约 $1.006992、token 数约 100.63M。帖子想表达的是:当模型和量化格式足够高效时,推理成本正在逼近“几乎免费”。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →