单张 GB200 聚类 10 万金融工具,64 卡扩展至百万级
PyTorch · x · 2026-09-11
PyTorch 官方转引 NVIDIA 技术博客,介绍 GPU 加速的金融工具聚类管线 AdaptGrow:
- 方法:基于对称非负矩阵分解(SymNMF),从滚动相关矩阵和尾部成对依赖矩阵(TPDM)中产出硬聚类标签、软因子载荷与结构突变信号
- 显存优化:峰值存储从约 20n² 降至 4n² 字节,单张 GB200 可对约 10 万个工具做分解
- 分布式扩展:按行分片依赖矩阵、经 NCCL 通信 O(nk) 数据,64 张 GB200(16 节点)可扩展到 100 万个工具
- 自动配置:根据矩阵特征谱自动选择 full-batch AdaGrad(谱间隙清晰)或 block-stochastic SVRG(谱较平),单卡到多卡接口一致
- 稳定性追踪:250 个滚动窗口(约一个交易年)中用自校准 3σ 控制限的调整兰德指数(ARI)检测成员变动;TPDM 还能捕捉相关性遗漏的跨行业共跌事件
附完整可复现 notebook(clusteringthroughtime.ipynb)与 SymNMF-factors 仓库。
「Infra」频道最新
- NVIDIA 携手 Palantir,在 AIPCon 11 上展示供应链本体合作 — eliano · 2026-09-11
- KV Cache 也做 QAT?技术拆解解释某模型 fp4 精度下表现更好 — stochasticchasm · 2026-09-11
- 网友猜测 Anthropic 走谷歌加部分 AWS,OpenAI 绑定微软 Azure — ericwdolan · 2026-09-11
- 技术账号拆解某模型 engram 细节:素数表长、4-gram、fp8 — stochasticchasm · 2026-09-11
- 英伟达:Vera Rubin 每 MW 吞吐为 Blackwell Ultra 的 50 倍,token 成本降 35 倍 — Beth_Kindig · 2026-09-11
- Epoch AI:GPT 长上下文延迟呈二次增长,定价跳档源于架构差异 — Jsevillamol · 2026-09-11