DeepSeek V4 Flash 本地实测:DGX Spark 性能与性价比双赢
Porespellar · reddit · 2026-08-11
作者认为 DeepSeek V4 Flash 0731 模型将成为推动 NVIDIA DGX Spark 等基于 GB10 芯片系统销售的“杀手级应用”。结合最新的 NVFP4 支持,该模型在双节点 Spark 集群上运行极佳。
核心实测表现:
- 速度与能力:在特定的 vLLM 配置下可达 60 tokens/s,支持 100 万上下文窗口,且在智能体编码任务中表现优异。
- 硬件对比:DGX Spark 在提示词处理速度上优于 Strix 和 Apple M4/M5 设备,这对智能体工作效率至关重要。虽然 Spark 存在内存带宽限制,但目前的运行速度已大幅弥补了这一短板。
- 市场观察:随着软件支持成熟和模型优化,作者对 Spark 的购买后悔度从几个月前的 50% 降至 0%。预计随着 DeepSeek 表现的显现,市场上可能会出现 Spark 的缺货潮。
「Infra」频道最新
- SGLang更新:支持Kimi K3与本地视频生成 — ying11231 · 2026-08-11
- OpenAI 高管分享德州 AI 基础设施建设进展 — gdb · 2026-08-11
- 跨数据中心 RL 训练优化:500GB 模型权重同步降至 500MB — AI Engineer · 2026-08-11
- Anthropic 签下百亿大单,采购英伟达 Vera Rubin 算力 — Beth_Kindig · 2026-08-11
- Agent 账单暴增 9 倍?上下文窗口的平方级成本陷阱与优化指南 — Warm-Reaction-456 · 2026-08-11
- Cloudflare Computer架构解析:为AI智能体打造持久化文件系统 — craigsdennis · 2026-08-11