GLM 5.3 Flash 实测吞吐 236 tok/s,作者将发布完整性能数据

TheZachMueller · x · 2026-10-02

作者分享了 GLM 5.3 Flash 的初步吞吐量实测:单并发(c=1)约 236 tok/s,4 并发下每用户约 160 tok/s,8 并发下每用户约 100 tok/s。他表示即将运行完整的 AI 性能测试,之后会正式发布完整结果,并请网友继续提供真实 benchmark 供测试。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →