双卡 RTX 6000 Pro 即可本地跑满 DeepSeek 1M 上下文

dee_hw · x · 2026-08-03

开发者分享了最新的本地 AI 工作站组装方案:选用两张 RTX PRO 6000 显卡。得益于 DeepSeek V4-Flash 采用的滑动窗口注意力机制,KV 缓存仅需保留局部窗口,因此该双卡配置(192GB 显存)足以在桌面端静音运行完整的 100 万上下文窗口,而无需升级为笨重嘈杂的 4 卡或 8 卡服务器。

所属事件:DeepSeek-V4-Flash 多硬件实测:从消费级到 DGX Spark 全覆盖(26 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →