GLM 5.3实测:Prefill约1 ktok/s,输出60 tok/s,性能超预期

yacineMTB · x · 2026-08-14

Tim Dettmers实测GLM 5.3,Prefill约1 ktok/s,思考/输出约60 tok/s。在完整思考轨迹下,GLM 5.2已优于Fable+Claude Code,而GLM 5.3更精准简洁,正在测试长任务性能。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →