GLM 5.3 Flash 实测吞吐 236 tok/s,作者将发布完整性能数据
TheZachMueller · x · 2026-10-02
作者分享了 GLM 5.3 Flash 的初步吞吐量实测:单并发(c=1)约 236 tok/s,4 并发下每用户约 160 tok/s,8 并发下每用户约 100 tok/s。他表示即将运行完整的 AI 性能测试,之后会正式发布完整结果,并请网友继续提供真实 benchmark 供测试。
「模型」频道最新
- Animation Bench 揭晓:GPT-6.1 Sol 综合第一,单任务成本仅 $0.46 — himanshustwts · 2026-10-02
- GPT-6.1 Sol 登顶 Animation Bench,动作一致性首破 0.5 — himanshustwts · 2026-10-02
- Meta 模型 Muse 惊艳众人,一周助推股价涨 10% — alexandr_wang · 2026-10-02
- 传 Anthropic 将推 Fable 5.5,版本号跳 0.4 节奏加快 — ChrisGPT · 2026-10-02
- VAmoS Pro 语音基准:Grok 任务最强,GPT-Live 响应最快 — davlanade · 2026-10-02
- 网友观察:Opus 5.5 频繁使用「himbo」一词,系历代 Claude 首见 — repligate · 2026-10-02