GPU 主动发网络请求:PyTorch GIN 让 all-to-all 提速 30%
PyTorch · x · 2026-09-30
AMD 的 Rishi Sinha 将在 PyTorch Conference North America 演讲,介绍 RCCL 团队与 TorchTitan(分布式训练框架)的整合工作:GPU-initiated networking (GIN) 让 GPU kernel 直接向远程 GPU 发起网络 put 操作,绕过通信开销这一分布式训练最大瓶颈之一。该方案使 all-to-all kernel 性能提升最高 30%,端到端性能提升 12%–15%。会议 10 月 20–21 日在圣何塞举行。
「Infra」频道最新
- Nvidia 拟联合保险公司将 GPU 变成可投资资产类别,仿照飞机融资模式 — ivan_bezdomny · 2026-09-30
- Nvidia 在纽约气候周被抨击:AI 扩张正在侵占资源 — iceCupa · 2026-09-30
- 微软 WSL 容器正式 GA:Windows 上原生构建运行 Linux 容器 — unixterminal · 2026-09-30
- SF Compute 确认向 AI 初创 neolabs 供应 GPU — charles_irl · 2026-09-30
- 供应商放话:千台 R200 NVL8 明年中可供亚太长租 — ns123abc · 2026-09-30
- Targon 上线 Bare Metal 与秒级 Sandboxes 算力服务 — JosephJacks_ · 2026-09-30