DeepSeek-V4-Flash 成功在 4 张 4090 上跑通 256k 上下文
dangerous_inference · reddit · 2026-08-05
开发者成功在 4 张 48GB 版 4090(SM89)服务器上,通过 DSpark 和 vLLM 成功部署并运行了 DeepSeek-V4-Flash 模型。目前该环境已支持 256k 上下文,展示了在消费级/改装级硬件上运行庞大模型的新突破。
「Infra」频道最新
- 电网不堪重负,德州州长全面叫停新建数据中心 — KyeGomezB · 2026-08-05
- AI 算力新瓶颈?西部数据近线硬盘出货量或成关键指标 — tengyanAI · 2026-08-05
- 本地 DGX Spark 部署 MiniMax-H3 模型实战与优化指南 — aisaint · 2026-08-05
- 降低 GPU 成本的关键:冷启动时间而非单纯 UX 体验 — MaxChamp08 · 2026-08-05
- Megakernels 已死?推理工程大师课激辩算力优化与内核融合 — Latent Space · 2026-08-05
- ComfyUI 跑大模型显存爆满?多模型串联工作流内存管理排错 — Alekite · 2026-08-05