双 Spark 硬件本地跑 DeepSeek:40 tok/s 实现完全无审查推理

Teknium · x · 2026-08-09

开发者分享了使用两台 Spark 设备通过单线连接,在本地运行 DeepSeek V4 Flash 0731 去审查版(abliterated)的实测体验。

该配置在未使用 dSpark 的情况下,推理速度可达约 40 tokens/秒,实现了完全本地化且无审查的私密推理。Teknium 确认该方案在 Hermes Agent 中运行良好。

所属事件:双Spark本地跑DeepSeek去审查版,速度达40 tok/s(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →