Baseten 推出 GLM-5.2 Fast API,吞吐提升 2 到 3 倍
baseten · x · 2026-07-24
Baseten 宣布推出新的 Fast tier Model APIs,首发支持 GLM-5.2。官方称这个新档位面向实时性要求很高的场景,吞吐量可比标准版 提升 2-3 倍 TPS。
这条本质上是 模型服务与推理层 的产品更新,不是模型本体发布,重点在 API 分层、实时性能和服务能力。
所属事件:Baseten 推出 GLM-5.2 Fast 实时 API(4 条相关)→
「公司和人」频道最新
- 曝 Stripe 洽购 OpenRouter,估值或高达百亿美元 — zephyr_z9 · 2026-07-24
- DoorDash 称 30 亿单经验正在押注机器人和 AI — saranormous · 2026-07-24
- YC 加持 Daqstra,要做测试基础设施的 AI 原生层 — ycombinator · 2026-07-24
- NVIDIA 称已成 Hugging Face 最大机构贡献者 — ctnzr · 2026-07-24
- A16Z American Dynamism 首映现场直接变成 AI 电影梗 — espricewright · 2026-07-24
- AMD AAI 活动聚齐 Ryoyo、Quanta、SemiAnalysis 和 tinygrad — DavidBennett__ · 2026-07-24