NCCL 2.31.2 发布:GPU 驱动细粒度通信与 0-SM 集合通信等改进
SkyLi0n · x · 2026-09-23
NCCL 2.31.2 发布,主要更新包括:GPU 驱动的 CFT/RMA 细粒度通信、按集合通信的逐项调优、NVLS+PAT 改进、0-SM collectives、多网卡/GIN 支持增强以及 PACE 融合等。作者认为这些特性对 MoE、FSDP、TP/EP 并行以及 Blackwell 规模的大模型训练有实际价值。
所属事件:NVIDIA 发布 NCCL 2.31.2:GPU 驱动通信与 0-SM 集合通信升级(2 条相关)→
「Infra」频道最新
- ARK 分析师:AI 是史上最高效的「能量-经济」转换器,效率约为人类 10 倍 — DMaguireARK · 2026-09-23
- 内存为何再也不便宜?David Bau:KV cache 抬高每比特 RAM 价值 — davidbau · 2026-09-23
- AI 让内核漏洞利用平民化,容器不再构成安全边界 — OwariDa · 2026-09-23
- 推理需要芯片、内存与散热:AI 让智能的物质性显形 — demian_ai · 2026-09-23
- Go.AI 获 8500 万美元 A 轮融资,主攻受监管行业本地化 AI — PTrubey · 2026-09-23
- InstinctFlash 开源运行时:单张商用 GPU 实时跑 8 系列机器人通用模型 — chris_j_paxton · 2026-09-23