双 DGX Spark 集群跑 Qwen3.8 MTP 版遇 stall,作者求 llama.cpp 启动参数
Impossible_Art9151 · reddit · 2026-10-08
一位用户在两台 DGX Spark 组成的集群上已成功运行 deepseek-flash,现尝试用 llama.cpp 跑 unsloth 的 qwen3.8-flash-next MTP 版本,但启动命令触发 dgx-stall。帖中给出了完整启动参数(layer 级 split、draft-dspark 投机解码、256k 上下文、RPC 配置等),并提到两个 MTP GGUF 文件(shared 与非 shared 各一)不知如何正确加载,向社区求助。
「Infra」频道最新
- MIT 科技评论:工业自主 AI 时代需要新的数据与治理框架 — nordicinst · 2026-10-08
- 博主调优本地配置跑到 100+ token/s,称再加内存条还能提升 — yangyi · 2026-10-08
- 三星开源 LittleBit:13B 模型压到 1GB,推理提速 11.6 倍 — ChrSzegedy · 2026-10-08
- 六年前的 A100 仍是 AI 论文最常引用的 Nvidia 芯片 — nathanbenaich · 2026-10-08
- 云厂商积压订单达 1.69 万亿美元,CoreWeave 季收 25.8 亿 — nathanbenaich · 2026-10-08
- 拆解 Chrome DecisionModel API:完整提示词与引擎实测 — dejanseo · 2026-10-08