中国 AI 生态转向 MoE 超节点
teortaxesTex · x · 2026-07-20
这条帖子的核心是:中国 AI 生态正在围绕 MoE + wide EP 形成共识,目的是让模型能在更弱的 NPU、以及更受限的 HBM/带宽条件下跑起来。
配图里还展示了多家国产基础设施方案,说明“更大的 supernode”正在成为系统设计趋势,包括:
- 壁仞的 1024 卡 scale-up 集群,结合 NPO 光互连;
- 曦望的下一代 AI SuperNode,单柜支持 64 卡 GPU 高速互连,并可扩展到 1 万卡以上;
- 中科曙光的 SUGON-8000 SuperCluster,用于科学计算、训练、推理和工业仿真;
- 阿里的 Zhenwu-890 / Panjiu AL128 SuperNode,单柜 128 芯片,号称支持 Pb/s 级带宽。
整体传达的是:国产算力系统不只是“拼芯片”,而是在拼集群级互连与更大域的系统架构。
「Infra」频道最新
- SkyPilot 出站并拿到 2000 万美元种子轮 — jfiance · 2026-07-22
- Nothing 手机把电影梗做成了模块化设计玩笑 — ZeYanjie · 2026-07-22
- Actual Computer 称其推理栈已适配英伟达消费级 Blackwell — markjeffrey · 2026-07-22
- Ben Bajarin 称市场仍严重低估 CPU 需求 — BenBajarin · 2026-07-22
- 能源模型称美国或从 2028 年起面临天然气短缺 — churchkey · 2026-07-22
- Devin 接入 e2b 沙箱,支持远程 agent 执行 — badphilosopher · 2026-07-22