NVIDIA 详解 NVLink Fusion:让自研 XPU 接入 NVLink 的 AI 工厂体系

NVIDIA Blog · rss · 2026-08-24

NVIDIA 官方博客长文介绍 NVLink Fusion:让超大规模厂商与 AI 原生公司的自研 XPU 接入 NVIDIA 的 AI 基础设施体系,构建「半定制」AI 工厂。

为什么需要:AI 工厂的经济性由 tokens/s、tokens/watt、成本/token、利用率与正常运行时间定义;自研 XPU 的团队常低估从芯片创新到数据中心部署的复杂度(高速接口、scale-up 网络、机架与散热、供应商生态等)。

性能数据:第六代 NVLink 在 72-XPU 域内,XPU 到 XPU 传输端到端延迟比以太网方案低 3 倍,包率高 10 倍;NVLink-C2C 连接 XPU 与 Vera CPU 时能效最高达 PCIe 的 6 倍;未来路线图包括最多 1,152 加速器的域和共封装光学。

生态与部署:Intel、MediaTek、GUC、QCT/Quanta、Amazon Annapurna Labs 等高管均表态支持;可复用 MGX 机架架构与供应链;配合 NVIDIA DSX 参考架构与 Omniverse 数字孪生,在动工前完成验证,支持机架级液冷热插拔维护。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →