PyTorchCon 将展示 MoRI+vLLM:AMD GPU 上跨 pod MoE 推理

PyTorch · x · 2026-10-11

在 PyTorch Conference North America 2026 上,AMD 的三位工程师将展示「MoRI + vLLM」:面向 AMD Instinct GPU 的 disaggregated MoE 服务方案。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →