GLM 5.3 Flash 重写内核上线 RunInfra:670 tok/s、缓存命中率 99.7%

ycombinator · x · 2026-10-01

RunInfra 宣布重写了 GLM 5.3 Flash 背后的推理内核,正式上线 major release,并在 Vercel AI Gateway 跑出 670 tok/s 的速度。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →