双 DGX Spark 跑通 Qwen3.8-Flash-Next
NVIDIAAI · x · 2026-08-27
MiaAI Lab 展示了在两张 NVIDIA DGX Spark 上运行 Qwen3.8-Flash-Next-NVFP4 的完整方案。该方案支持 90 万上下文与视觉能力,使用 SGLang 框架和 NVFP4 量化。实测单流约 64 tok/s,2-4 并发会话约 115 tok/s。项目提供了自动化脚本,涵盖权重下载、内核补丁构建及集群启动。
「Infra」频道最新
- vLLM 跑分:DeepSeek V4 Pro 达 13 万 tok/s — AccBalanced · 2026-08-27
- Google Cloud Run 推出实例:单命令部署 Linux 微 VM — steren · 2026-08-27
- Anthropic 签 45 亿美元算力协议,部署英伟达 Rubin 芯片 — Beth_Kindig · 2026-08-27
- DeepSeek-v4-Pro 1美元生成1.3亿Token,成本骤降77倍 — bookwormengr · 2026-08-27
- NVIDIA FLARE 实现联邦多模态训练,通信量降 99% — dl_weekly · 2026-08-27
- 同预算怎么选:256GB Mac 还是两台 DGX Spark — Whyme-__- · 2026-08-27