开发者实测双 Spark 驱动本地跑 DeepSeek,实现无审查推理
PMinervini · x · 2026-08-09
开发者 Teknium 分享了其本地部署经验:通过一根数据线连接两块 Spark 硬件,在未启用 dspark 的情况下运行经过去审查处理的 DeepSeek v4 flash 0731 模型,实现了完全私密且无审查的推理,速度可达约 40 tokens/s。
随后,其他开发者向他请教了具体的去审查实现方式,猜测是否使用了 ds4 的方向控制功能。
所属事件:双Spark本地跑DeepSeek去审查版,速度达40 tok/s(3 条相关)→
「Infra」频道最新
- 开源方案 RobotSoul:为 Agent 提供上下文重置后的持久身份 — robauto-dot-ai · 2026-08-24
- 将 MoE 模型卸载至 RAM 运行会遭遇极慢的 Prefill — former_farmer · 2026-08-24
- Etched获10亿美元融资,Jane Street领投验证专用芯片 — TheTuringPost · 2026-08-24
- ConvRot 量化方法入驻 llama-cpp,Q6 接近 Q8 精度 — giveen · 2026-08-24
- LifeOS:基于本地模型的语音驱动个人管理工具 — Extension-Bid-639 · 2026-08-24
- 超算中心硬件选型:SSD与HDD的密度权衡 — generativist · 2026-08-24