双 Spark 硬件本地跑 DeepSeek:40 tok/s 实现完全无审查推理
Teknium · x · 2026-08-09
开发者分享了使用两台 Spark 设备通过单线连接,在本地运行 DeepSeek V4 Flash 0731 去审查版(abliterated)的实测体验。
该配置在未使用 dSpark 的情况下,推理速度可达约 40 tokens/秒,实现了完全本地化且无审查的私密推理。Teknium 确认该方案在 Hermes Agent 中运行良好。
所属事件:双Spark本地跑DeepSeek去审查版,速度达40 tok/s(3 条相关)→
「Infra」频道最新
- 开源方案 RobotSoul:为 Agent 提供上下文重置后的持久身份 — robauto-dot-ai · 2026-08-24
- 将 MoE 模型卸载至 RAM 运行会遭遇极慢的 Prefill — former_farmer · 2026-08-24
- Etched获10亿美元融资,Jane Street领投验证专用芯片 — TheTuringPost · 2026-08-24
- ConvRot 量化方法入驻 llama-cpp,Q6 接近 Q8 精度 — giveen · 2026-08-24
- LifeOS:基于本地模型的语音驱动个人管理工具 — Extension-Bid-639 · 2026-08-24
- 超算中心硬件选型:SSD与HDD的密度权衡 — generativist · 2026-08-24