Qwen3.8-9B 蒸馏模型推出 GGUF 版可本地运行
empero-ai 在 Hugging Face 上放出了基于 Qwen3.8 蒸馏与推理优化的 Qwen3.8-9B-Distill-GGUF 量化模型,支持 llama.cpp 本地部署。标签中还出现了 gated-deltanet 架构字样,引发社区关注。该版本让用户无需高端设备即可在本地运行这款模型。
2026-08-19 ~ 2026-08-19 · 2 条相关
- Qwen3.8-9B 推出 GGUF 量化版,适配 llama.cpp 本地部署 — empero-ai · 2026-08-19
- Qwen3.8-9B 蒸馏模型推出 GGUF 版,llama.cpp 本地量化可跑 — empero-ai · 2026-08-19