DeepSeek V4 Flash DSpark 在双 DGX Spark 上跑出高吞吐
sqrlmstr5000 · reddit · 2026-07-24
DeepSeek V4 Flash DSpark 在双 DGX Spark 上跑出不错吞吐
一位用户称,DeepSeek V4 Flash DSpark 是他在 双 DGX Spark / Dell GB10 机器上试过之后,速度和质量都最好的本地模型方案。
他给出的体验包括:
- 在 VS Code 里明显比 Copilot 更快
- 主观上质量接近 Sonnet 4.6
- 长任务成功率大约 99%
- 规划能力和指令遵循都很好
证据主要来自一张监控图:展示了当天的 model tokens/sec 和 prompt tokens/sec,生成吞吐峰值大约在 50+ t/s,prompt 吞吐峰值超过 4K t/s。
「Infra」频道最新
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11
- 7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据 — thenomadexplorerlife · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11