英伟达实现百万级矩阵分解,单卡显存容量翻倍

marc_stampfli · x · 2026-07-30

NVIDIA 研究团队发表了一项关于加速对称非负矩阵分解的研究,成功将计算规模扩展至 100 万×100 万 的矩阵,并跨 64 块 GB200 GPU 进行分布式运算。

技术突破

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →