DeepSeek-V4-Flash 成功在 4 张 4090 上跑通 256k 上下文

dangerous_inference · reddit · 2026-08-05

开发者成功在 4 张 48GB 版 4090(SM89)服务器上,通过 DSpark 和 vLLM 成功部署并运行了 DeepSeek-V4-Flash 模型。目前该环境已支持 256k 上下文,展示了在消费级/改装级硬件上运行庞大模型的新突破。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →