双Spark本地跑DeepSeek去审查版,速度达40 tok/s

开发者Teknium通过一根线缆连接两台NVIDIA DGX Spark设备,在本地运行经过去审查处理(abliterated)的DeepSeek V4 Flash 0731模型,实测生成速度可达40 tok/s。该配置未启用dspark,实现了完全无审查的推理体验,为本地部署高性能模型提供了新思路。

2026-08-09 ~ 2026-08-09 · 3 条相关