GLM 5.2在AMD MI355X上实现单节点2626 tok/s推理
工程师成功在AMD MI355X加速器上部署并服务开源大模型GLM 5.2,展现了非英伟达硬件平台的推理优化能力。实测数据显示,该部署在单节点上实现了高达2626 tok/s的吞吐量,单流吞吐量也达到213 tok/s。这一成果登上了Hacker News热榜,证明了AMD芯片对主流开源大模型的强劲支持。
2026-07-05 ~ 2026-07-05 · 2 条相关
- GLM 5.2在AMD MI355X上单节点跑出2626 tok/s — burny_tech · 2026-07-05
- GLM 5.2在AMD MI355X实现单节点2626 tok/s推理 — SumitGup · 2026-07-05