AMD MI355X 集群实测:11 节点跑 Llama 2 70B 破百万 tokens/s

AntDX316 · x · 2026-08-05

AMD MI355X GPU 在多节点集群推理上展现出强劲性能。据 Grok 分享的测试数据,11 个节点(87 张 MI355X)运行 Llama 2 70B 模型时,在线推理速度达到 101.6 万 tokens/s,离线推理速度达 104.2 万 tokens/s,集群扩展效率高达 93%–98%。此外,单节点 MI355X 的推理速度也达到了 10 万 tokens/s 的标记。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →