双卡 192GB 玩家跑通 456GB 版 DeepSeek v4.1,SSD 分担专家权重

HankYeomans · x · 2026-10-08

开发者 HankYeomans 分享了一个本地运行 DeepSeek v4.1 Flash MXFP4 的混合方案:模型总大小约 456GB,他用两块 GPU(合计 192GB 显存)加载核心部分,放不下的 MoE 专家权重则分配到内存和 SSD。他表示目前响应质量已经「相当不错」,但也承认这只是小型测试。

这条帖子展示了超大 MoE 模型在消费级/工作站级硬件上跑通的一种思路——用分层存储(显存 + 内存 + SSD)换取有限显存下的完整模型运行,对本地部署社区有参考价值。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →