GLM 5.2在AMD MI355X实现单节点2626 tok/s推理

SumitGup · x · 2026-07-05

工程师展示在AMD MI355X加速器上服务GLM 5.2模型,单节点吞吐达2626 tok/s,单流吞吐213 tok/s。体现了非英伟达硬件平台对主流开源大模型的推理优化能力与竞争力。

所属事件:GLM 5.2在AMD MI355X上实现单节点2626 tok/s推理(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →