Baseten将GLM-5.2提速至280 tok/s

Baseten 宣布将 GLM-5.2 的推理服务优化到发布初期两倍以上,API 峰值达 280 tokens/s、平均约 100 tokens/s,并推出面向 coding 和 agent 场景的低延迟 Fast 版本。团队称这使其成为当时最快的 GLM-5.2 API 实现。

2026-07-26 ~ 2026-07-27 · 3 条相关

事件全程(共 2 集)→