中国 AI 生态转向 MoE 超节点
teortaxesTex · x · 2026-07-20
这条帖子的核心是:中国 AI 生态正在围绕 MoE + wide EP 形成共识,目的是让模型能在更弱的 NPU、以及更受限的 HBM/带宽条件下跑起来。
配图里还展示了多家国产基础设施方案,说明“更大的 supernode”正在成为系统设计趋势,包括:
- 壁仞的 1024 卡 scale-up 集群,结合 NPO 光互连;
- 曦望的下一代 AI SuperNode,单柜支持 64 卡 GPU 高速互连,并可扩展到 1 万卡以上;
- 中科曙光的 SUGON-8000 SuperCluster,用于科学计算、训练、推理和工业仿真;
- 阿里的 Zhenwu-890 / Panjiu AL128 SuperNode,单柜 128 芯片,号称支持 Pb/s 级带宽。
整体传达的是:国产算力系统不只是“拼芯片”,而是在拼集群级互连与更大域的系统架构。
「Infra」频道最新
- NVIDIA 称 Nemotron 3 Ultra 在 RTL 芯片设计任务上达 97.1% — NVIDIAAI · 2026-07-27
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27
- MiniBot 2.40 新增 xAI、HF Studio 和 vLLM 支持 — Creative-Type9411 · 2026-07-27
- 苹果智能眼镜、英伟达SK合作与携程51.79亿罚单汇总 — APPSO · 2026-07-27
- DeepSeek 融资传闻、欧盟 AI 透明度规则与 OpenAI 安全事故 — 创业邦 · 2026-07-27
- QuixiCore 主张原生量化内核取代先反量化再执行 — QuixiAI · 2026-07-27