英伟达 UMAP 支持多 GPU,处理 870GB 数据仅需 8 分钟
leland_mcinnes · x · 2026-08-20
NVIDIA cuML 和 cuVS 库更新,为 UMAP 算法引入了多 GPU 支持。新实现通过平衡聚类分区、独立计算局部 kNN 图并合并,避免了全对全通信。在 MIRACL 和 Wiki 数据集上的测试显示,使用 8 张 H100 GPU 可比 CPU 运行时提速最高 74 倍,使处理数百 GB 级工作负载成为可能,同时保持了嵌入质量。
所属事件:英伟达 UMAP 实现多 GPU 加速,870GB 数据仅需 8 分钟(2 条相关)→
「Infra」频道最新
- 英伟达发布 CUDA-Q Algorithms,构建容错量子计算原语库 — tomaszbednarz · 2026-08-20
- Dolphin Network 推出 GPU 闲置算力 P2P 推理网络 — toptickcrypto · 2026-08-20
- Epoch 估算:OpenAI 约 1.2%~2.4% 算力用于安全监控 — sjgadler · 2026-08-20
- 观点:Cerebras 极速推理或让 OpenAI 的研发闭环快 20 倍 — Scobleizer · 2026-08-20
- AI 智能体不是微服务,架构需引入持久执行层 — rseroter · 2026-08-20
- 实战:利用本地 Apple 模型优化产品个性化体验 — signulll · 2026-08-20