Lambda 组建万卡 GB300 集群,跑通 All-Reduce 算力测试
TheZachMueller · x · 2026-08-22
Lambda 宣布利用 10,368 张 NVIDIA GB300 GPU 建立大规模算力集群,并成功运行 All-Reduce 操作。该集群包含 9 个计算单元(pods)和 144 个机架。此举展示了其在超大规模 GPU 集群调度与互联方面的工程能力,通常用于大模型训练场景。
所属事件:Lambda 用万张 GB300 组建超大集群跑通 All-Reduce 测试(2 条相关)→
「Infra」频道最新
- Cloudera 推出 Anywhere Cloud 平台,主打 Agent 与数据主权 — DavidLinthicum · 2026-08-22
- 医院内网 MLOps 实战:监控自研与第三方模型 — zentax2001 · 2026-08-22
- Agent 负载需关注单线程效能,而非单纯堆核心数 — BenBajarin · 2026-08-22
- 光互联升级遇阻:制造瓶颈将延缓 CPO/NPO 普及 — BenBajarin · 2026-08-22
- 英伟达用线性代数解决多模型切换 KV 缓存难题 — bendee983 · 2026-08-22
- Anthropic 挖角谷歌 TPU 业务负责人,加码自研芯片 — nmasc_ · 2026-08-22