华为 10 万卡 Atlas-960 超集群曝光:30 天可训 10 万亿参数模型
teortaxesTex · x · 2026-09-18
据 @tphuang,华为的 10 万卡 Super Cluster 由 25 个 Atlas-960 SuperNode 组成,可在 30 天内以 100T tokens 训练 10 万亿参数模型。
- 同一集群可切分为 352 卡实例,用于驱动 10T 参数模型的推理
- 可扩展至 100 万卡,并纳入大型 CPU SuperPoD 与企业级存储
这是对标超大规模算力集群的重要算力布局信息。
「Infra」频道最新
- Google 开源 Agent Substrate:单机塞千个休眠 Agent,恢复仅 500ms — blaizedsouza · 2026-09-18
- Reddit 网友把 6 张 V100 塞进普通全塔机箱搭本地推理服务器 — Odd_Caterpillar_2994 · 2026-09-18
- Crusoe 融资 39 亿美元建 AI 数据中心,估值达 309 亿 — TechCrunch AI · 2026-09-18
- GPU 编程打卡第 257 天:推荐 2.5 小时半导体供应链入门课 — blaizedsouza · 2026-09-18
- YC F26项目Dreamscale:把机器人推理搬上云端 — ycombinator · 2026-09-18
- 社区为 Bonsai 2 27B 微调 MTP 头,推理提速约 1.25 倍 — cephaloform · 2026-09-18