英伟达 UMAP 支持多 GPU,处理 870GB 数据仅需 8 分钟

leland_mcinnes · x · 2026-08-20

NVIDIA cuML 和 cuVS 库更新,为 UMAP 算法引入了多 GPU 支持。新实现通过平衡聚类分区、独立计算局部 kNN 图并合并,避免了全对全通信。在 MIRACL 和 Wiki 数据集上的测试显示,使用 8 张 H100 GPU 可比 CPU 运行时提速最高 74 倍,使处理数百 GB 级工作负载成为可能,同时保持了嵌入质量。

所属事件:英伟达 UMAP 实现多 GPU 加速,870GB 数据仅需 8 分钟(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →