单台 Spark 硬件跑 DeepSeek V4,本地推理速度达 95 tok/s
Rasmic · x · 2026-08-06
有开发者分享了使用 Spark 硬件组建本地家庭实验室的运行实测。数据显示,仅用两台 Spark 即可运行 DeepSeek V4 (0731) 模型,且推理速度能达到约 95 tokens/秒。
该配置不仅具备大上下文窗口,且能以单台设备驱动前沿级大模型,实现了完全本地且私密的 AI 部署。
「Infra」频道最新
- Sapiom 获 3500 万美元 A 轮融资,推出 AI 智能体降本基建 — thisguyknowsai · 2026-08-06
- 谷歌云 Filestore 引入 Colossus 底层,实现容量与 IOPS 独立扩展 — rseroter · 2026-08-06
- 8x DGX Spark 节点开放世界多智能体实测 — NVIDIAAI · 2026-08-06
- 16x GB10 集群成功跑通 Kimi K3,峰值吞吐达 38tps — NVIDIAAI · 2026-08-06
- RTX 5090 本地大模型量化与 8GB 显存智能体性能基准测试 — max_paperclips · 2026-08-06
- 英伟达探讨基于专有数据构建安全的企业级 AI — nvidia · 2026-08-06