DeepSeek V4 Flash DSpark 在双 DGX Spark 上跑出高吞吐
sqrlmstr5000 · reddit · 2026-07-24
DeepSeek V4 Flash DSpark 在双 DGX Spark 上跑出不错吞吐
一位用户称,DeepSeek V4 Flash DSpark 是他在 双 DGX Spark / Dell GB10 机器上试过之后,速度和质量都最好的本地模型方案。
他给出的体验包括:
- 在 VS Code 里明显比 Copilot 更快
- 主观上质量接近 Sonnet 4.6
- 长任务成功率大约 99%
- 规划能力和指令遵循都很好
证据主要来自一张监控图:展示了当天的 model tokens/sec 和 prompt tokens/sec,生成吞吐峰值大约在 50+ t/s,prompt 吞吐峰值超过 4K t/s。
「Infra」频道最新
- Kimi K3 登陆 Together,预留吞吐成本低 65% — togethercompute · 2026-07-27
- OpenAI 可能撞上算力上限,Codex 和 ChatGPT Work 四个月涨到 1000 万 — JoshuaJBouw · 2026-07-27
- NVIDIA 称 Vera CPU 正加速下一代 CPU 和 GPU 设计 — nordicinst · 2026-07-27
- NVIDIA 称 Nemotron 3 Ultra 在 RTL 芯片设计任务上达 97.1% — NVIDIAAI · 2026-07-27
- NVIDIA 说 Vera CPU 让部分 EDA 工作负载提速 1.5 倍 — NVIDIA Blog · 2026-07-27
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27