10万 GPU 而非 NVL72 整机架:超大集群规模传闻被纠偏
firstadopter · x · 2026-09-07
firstadopter 纠正了流传的说法:所谓超大规模训练集群是 100,000 张 GPU,而不是 10 万台 NVL72 服务器(后者意味着 720 万张 Blackwell GPU)。他指出,百万级 GPU/TPU 的训练集群仍属未来,当前的规模估算被夸大了一个数量级。
「Infra」频道最新
- 作者更正:是 10 万+ GPU 折合约 1389 个 NVL72 机架 — YuXiang_IRVL · 2026-09-07
- 高盛看多韩股近 80% 上行空间,AI 存储热潮驱动 Kospi 目标 12000 — Polymarket · 2026-09-07
- Astra 算力效率几何?业界推算前沿模型训练成本差距可达十倍 — teortaxesTex · 2026-09-07
- 白嫖 20 小时:Kaggle 免费跑 Qwen3 27B 供 Agent 调用 — TheMoonMidas · 2026-09-07
- llama.cpp 跑 Qwen3.6-35B MTP 投机解码,求 draft 接受率调优 — Bulky-Priority6824 · 2026-09-07
- Google 发布 MaxKernel:多智能体系统自动写 TPU kernel 达专家级 — google · 2026-09-07