GLM-5.3 开放权重: SGLang 实测多轮代理任务超 500 tok/s
BanghuaZ · x · 2026-08-28
Zai 发布 GLM-5.3 开放权重模型,定位为面向代理编程和网络安全的最强模型。SGLang 宣布首发支持,并在 Blackwell/Hopper 和 AMD MI300 系列硬件上进行了性能实测。
核心性能数据:
- 在多轮代理工作负载下,BS=1、TP8 配置时:
- NVFP4 精度达到 537.6 tok/s/user
- FP8 精度达到 413 tok/s/user
该模型继承了 GLM-5.2 的优化特性,现已可在 NVIDIA Blackwell、Hopper 及 AMD MI300X/325X/355X 上生产部署。
所属事件:智谱发布 GLM-5.3 开放权重,主打智能体编程与网络防御(7 条相关)→
「Infra」频道最新
- Cerebras CEO 解析架构:推理速度为何比 GPU 快 2500 倍 — rohanpaul_ai · 2026-08-29
- 形式化验证虽助 AI 安全,或加速硬件军备竞赛 — geoffreyirving · 2026-08-29
- 双 3080Ti 组建本地 Swarm 集群,加速 Qwen 推理 — Forward_Jackfruit813 · 2026-08-29
- Microduck 硬件成本分析:$10 售价是否可行? — NickPassig · 2026-08-29
- 双 3090 跑通 Qwen3.8-27B:DFlash2 加速实测与全流程配置 — Old_Ad_6033 · 2026-08-29
- 观点文章:数据中心是下一代港口,社区将围绕智能流动而建 — McDonaghMatthew · 2026-08-29