开发者实测双 Spark 驱动本地跑 DeepSeek,实现无审查推理

PMinervini · x · 2026-08-09

开发者 Teknium 分享了其本地部署经验:通过一根数据线连接两块 Spark 硬件,在未启用 dspark 的情况下运行经过去审查处理的 DeepSeek v4 flash 0731 模型,实现了完全私密且无审查的推理,速度可达约 40 tokens/s。

随后,其他开发者向他请教了具体的去审查实现方式,猜测是否使用了 ds4 的方向控制功能。

所属事件:双Spark本地跑DeepSeek去审查版,速度达40 tok/s(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →