单台 Spark 硬件跑 DeepSeek V4,本地推理速度达 95 tok/s

Rasmic · x · 2026-08-06

有开发者分享了使用 Spark 硬件组建本地家庭实验室的运行实测。数据显示,仅用两台 Spark 即可运行 DeepSeek V4 (0731) 模型,且推理速度能达到约 95 tokens/秒。

该配置不仅具备大上下文窗口,且能以单台设备驱动前沿级大模型,实现了完全本地且私密的 AI 部署。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →