NVIDIA 详解 NVLink Fusion:让自研 XPU 接入 NVLink 的 AI 工厂体系
NVIDIA Blog · rss · 2026-08-24
NVIDIA 官方博客长文介绍 NVLink Fusion:让超大规模厂商与 AI 原生公司的自研 XPU 接入 NVIDIA 的 AI 基础设施体系,构建「半定制」AI 工厂。
为什么需要:AI 工厂的经济性由 tokens/s、tokens/watt、成本/token、利用率与正常运行时间定义;自研 XPU 的团队常低估从芯片创新到数据中心部署的复杂度(高速接口、scale-up 网络、机架与散热、供应商生态等)。
性能数据:第六代 NVLink 在 72-XPU 域内,XPU 到 XPU 传输端到端延迟比以太网方案低 3 倍,包率高 10 倍;NVLink-C2C 连接 XPU 与 Vera CPU 时能效最高达 PCIe 的 6 倍;未来路线图包括最多 1,152 加速器的域和共封装光学。
生态与部署:Intel、MediaTek、GUC、QCT/Quanta、Amazon Annapurna Labs 等高管均表态支持;可复用 MGX 机架架构与供应链;配合 NVIDIA DSX 参考架构与 Omniverse 数字孪生,在动工前完成验证,支持机架级液冷热插拔维护。
「Infra」频道最新
- Zai 开源 320B 模型 GLM-5.3,宣称全流程纯国产芯 — SumitGup · 2026-08-27
- 博主承认对英伟达数据理解有误 — EigenGender · 2026-08-27
- 英伟达数据为年化值,每季增 250 亿 — cis_female · 2026-08-27
- 英伟达 Q2 并未额外创造 1000 亿美元价值 — EigenGender · 2026-08-27
- 业界对 CPU 节点的兴趣近期显著回升 — Sethwinterroth · 2026-08-27
- llama.cpp 新增对 Nanbeige4.2-3B 模型的支持 — pmttyji · 2026-08-27