GLM 5.3 Flash 现身:DGX Spark 本地四路并发跑到 227 tok/s

natesiggard · x · 2026-10-08

MiaAIlab 演示了在 NVIDIA DGX Spark 上运行 GLM 5.3 Flash 的本地推理效果:4 路并发混合请求下达到约 227 tokens/s 的速度。发帖人称这个速度「看起来不真实」。这也是 GLM 5.3 Flash 这一版本号的公开现身信号,此前未见官方发布信息,模型细节尚待证实。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →