GLM 5.2在AMD MI355X上实现单节点2626 tok/s推理

工程师成功在AMD MI355X加速器上部署并服务开源大模型GLM 5.2,展现了非英伟达硬件平台的推理优化能力。实测数据显示,该部署在单节点上实现了高达2626 tok/s的吞吐量,单流吞吐量也达到213 tok/s。这一成果登上了Hacker News热榜,证明了AMD芯片对主流开源大模型的强劲支持。

2026-07-05 ~ 2026-07-05 · 2 条相关