Baseten 推出 GLM-5.2 Fast,实时场景吞吐提速 2-3 倍
baseten · x · 2026-07-24
Baseten 推出了 GLM-5.2 Fast,面向对实时性要求很高的场景。
官方称,这个 Fast 档位的吞吐量(TPS)比标准版 GLM-5.2 Model API 高出 2-3 倍,现在已经可以试用。
所属事件:Baseten推出GLM-5.2 Fast API大幅提升吞吐量(4 条相关)→
「Infra」频道最新
- Ben Bajarin 认为半导体和 AI 基建仍被低估 — BenBajarin · 2026-07-24
- Geekbench 7 重置分数体系,Snapdragon X2 Elite 多核提升接近 16% — ryanshrout · 2026-07-24
- 英特尔确认 2028 年大规模量产 14A 工艺 — BenBajarin · 2026-07-24
- Pydantic AI 展示 agent 一票分出 40 组测试,笔记本风扇先炸了 — AAAzzam · 2026-07-24
- Fluidstack 完成 8.3 亿美元 A 轮,估值达 75 亿美元 — MxMnr · 2026-07-24
- Google 今年 capex 指引已超过其 2021 年前全部累计开支 — ivan_bezdomny · 2026-07-24