Baseten 称 GLM-5.2 Fast 实时吞吐提升 2 到 3 倍

baseten · x · 2026-07-24

Baseten 发布了面向实时场景的 GLM-5.2 Fast 托管模型 API,官方说法是它比标准版 GLM-5.2 MAPI 的 TPS 高 2-3 倍。转述里还提到,有开发者已经把它当作自己在 opencode 里的主力编码模型,并给出了相应的配置方式,说明这不只是模型本身,而是与推理托管和开发工作流相关的基础设施动态。

所属事件:Baseten推出GLM-5.2 Fast API,吞吐量提升2-3倍(6 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →