Baseten 称 GLM-5.2 Fast 实时吞吐提升 2 到 3 倍
baseten · x · 2026-07-24
Baseten 发布了面向实时场景的 GLM-5.2 Fast 托管模型 API,官方说法是它比标准版 GLM-5.2 MAPI 的 TPS 高 2-3 倍。转述里还提到,有开发者已经把它当作自己在 opencode 里的主力编码模型,并给出了相应的配置方式,说明这不只是模型本身,而是与推理托管和开发工作流相关的基础设施动态。
所属事件:Baseten推出GLM-5.2 Fast API,吞吐量提升2-3倍(6 条相关)→
「编程与Agent」频道最新
- 一个插件让 agent 控制 Codex Micro 灯效:邮件、Stripe、子 agent 都能触发 — dkundel · 2026-07-24
- LangChain 展示 Rillet 用 LangSmith 监控 AI agents — LangChain · 2026-07-24
- localbrain 用一条命令把本地 AI 接进任意应用 — Everglow915 · 2026-07-24
- Nous Research 的 Hermes Agent 在 Buzz 里发出首条消息 — Teknium · 2026-07-24
- 开源 WordPress MCP 插件让 agent 以最小权限访问站点 — wpninjapro · 2026-07-24
- Agent 动作超时暴露了重试与验证模型缺口 — Technical_Bench_188 · 2026-07-24