Baseten 宣称 GLM-5.3-Flash 推理速度达 122+ TPS

baseten · x · 2026-08-28

Baseten 宣布其在 Artificial Analysis、OpenRouter 和 Hugging Face 上为 GLM-5.3-Flash 提供最快推理服务,速度超过 122 TPS。服务全美部署,默认开启零数据保留 (ZDR),并表示将持续优化以提升吞吐并降低延迟。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →