外卖巨头造前沿模型:美团 LongCat 的 N-gram 注意力与国产算力突围
bookwormengr · x · 2026-09-21
一篇深度长文剖析了美团 LongCat 实验室的崛起:LongCat 2.0 是首个已知在华为 910C 上训练的模型,很可能使用 CloudMatrix 384 超级节点(每节点 384 颗 NPU,对比 Nvidia NVL72 机架的 72 颗),官方称共动用约 5 万颗 ASIC。
作者认为外界关注模型本身,却低估了 LongCat 与华为工程的巧思:用「更弱」的器件、降低对 HBM 的依赖并发明新架构来突破美国出口管制。LongCat 团队展示了大胆的架构押注—— mastered 难训练的稀疏 MoE、发明了更好的注意力机制,并独立研发了 N-gram 稀疏化这条新的稀疏轴。推文还指出这展示了中国 AI 生态协同作战的能力,是 Uber、DoorDash 等西方同行难以想象的。
「Infra」频道最新
- 本地频繁换模型不用丢缓存:SGLang hicache 三层 KV 缓存实战 — TheZachMueller · 2026-09-22
- 埃及 AI 生态达生产级规模,4 亿美元数据中心落地 — nordicinst · 2026-09-22
- RTX Pro 6000 还是 3090?本地 LoRA 训练算力经济账对比 — big-in-jap · 2026-09-21
- ComfyUI 租卡实测:Modal 冷启动 35 秒、免费 1TiB 存储胜出 RunPod — ronalder100 · 2026-09-21
- Meta 携手 Arm 开发新一代数据中心 CPU「Arm AGI CPU」 — bookwormengr · 2026-09-21
- Starlink 席卷拉美农村教育:数万座天线连接数十万学生 — XFreeze · 2026-09-21