Qwen3.8-9B 蒸馏模型推出 GGUF 版,llama.cpp 本地量化可跑

empero-ai · hf · 2026-08-19

empero-ai 随后放出 Qwen3.8-9B-Distill-GGUF 量化版,支持 llama.cpp 本地部署,标签中还出现了 gated-deltanet 架构字样。配合蒸馏与推理标签,适合本地端侧运行场景,同样登上 HF 热榜。

所属事件:Qwen3.8-9B 蒸馏模型推出 GGUF 版可本地运行(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →