GLM 5.2在AMD MI355X上单节点跑出2626 tok/s

burny_tech · x · 2026-07-05

据waferai(登上Hacker News热榜第二),工程师成功在AMD MI355X上部署并服务GLM 5.2,单节点吞吐达2626 tok/s,单用户约213 tok/s,展示了非英伟达硬件在开源大模型推理上的潜力。

所属事件:GLM 5.2在AMD MI355X上实现单节点2626 tok/s推理(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →