英伟达 UMAP 实现多 GPU 加速,870GB 数据仅需 8 分钟
英伟达在 cuML 和 cuVS 库中为 UMAP 降维算法引入多 GPU 支持。新实现通过平衡聚类分区、各 GPU 独立计算局部 kNN 图再合并的方式,避免全对全通信,从而实现大规模数据的高效处理。在 MIRACL 数据集测试中,处理 870GB 数据仅需约 8 分钟,将原本耗时的 UMAP 计算压缩到分钟级。
2026-08-19 ~ 2026-08-20 · 2 条相关
- 英伟达发布多 GPU 方案:分钟级运行大规模 UMAP — leland_mcinnes · 2026-08-19
- 英伟达 UMAP 支持多 GPU,处理 870GB 数据仅需 8 分钟 — leland_mcinnes · 2026-08-20