本地跑满血 DeepSeek 需要什么硬件?社区热议并发方案

whoami-233 · reddit · 2026-08-01

一位开发者在社区求助,希望寻找最便宜且易于维护的硬件方案,以在本地运行满血版 DeepSeek 模型。

其核心需求包括:单次请求生成速度至少达到 25-30 tokens/s,支持至少 8 个并发请求(最好能支持 16 个),且需处理约 200k tokens 的长上下文智能体任务。作者初步考虑使用双 DGX Spark 配置,并向社区征集更优的硬件建议。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →