GLM-5.3-EX3 本地实测:98% 接受率、175 tok/s 生成

HankYeomans · x · 2026-10-02

用户分享本地部署数据:在两张 RTX 6k Pro 显卡上运行 GLM-5.3-EX3(推测性解码配置下),草稿接受率达到 98%,生成速度 175 tok/s,prompt 吞吐约 4100 tok/s。作者自己也觉得这组数字好得有些不真实。

所属事件:网友实测自托管 GLM 模型:双 RTX 6000 Pro 跑出 175 tok/s(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →