DGX Spark 运行 Qwen3.8-27B GGUF 命令示例

ariG23498 · x · 2026-08-17

展示了在 DGX Spark 平台上使用 llama serve 运行 Qwen3.8-27B GGUF 模型的具体命令。配置启用了推测解码(speculative decoding),包括 spec-default 和 spec-type draft-mtp,以及推理保留和代理模式。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →