DGX Spark跑稠密模型体验糟糕,MoE更适配统一内存

TheZachMueller · x · 2026-08-09

有开发者指出,在DGX Spark这类统一内存系统上,稠密模型(如Qwen 3.8 27B)体验很差,而MoE模型(每token激活参数少)更适合。对比显示,200K上下文、约200B参数(10B激活)的agent会话,在2台DGX Spark上需约22分钟,而2台RTX PRO 6000仅需2-3分钟,且并发和Tensor Parallelism在DGX Spark上扩展性更差。结论:GPU优于统一内存,除非只是聊天界面。

所属事件:DGX Spark跑大模型遭实测碾压,双RTX PRO 6000快近10倍(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →