Qwen3.8-9B 蒸馏模型推出 GGUF 版,llama.cpp 本地量化可跑
empero-ai · hf · 2026-08-19
empero-ai 随后放出 Qwen3.8-9B-Distill-GGUF 量化版,支持 llama.cpp 本地部署,标签中还出现了 gated-deltanet 架构字样。配合蒸馏与推理标签,适合本地端侧运行场景,同样登上 HF 热榜。
所属事件:Qwen3.8-9B 蒸馏模型推出 GGUF 版可本地运行(2 条相关)→
「模型」频道最新
- Unsloth 发布 Qwen3.8-27B 新量化版:精度提升 10% — danielhanchen · 2026-08-20
- Hugging Face 放出 SmolLM3 mid-training 检查点,回应 200 倍效率之争 — eliebakouch · 2026-08-20
- 5.6 Sol Ultra 搭配 computer use 被指像 Opus 4.5 搭配 MCP — curious_vii · 2026-08-20
- 实测 Gemini 3.7 Flash:极速 350 tok/s,代码能力存疑 — haider1 · 2026-08-20
- AntLing 开源 Ling-3.0 模型:WSM 合并替代 LR 衰减 — AcanthisittaOk1699 · 2026-08-19
- 10T 参数模型推理达 1000 TPS,AGI 实力差距引猜测 — legit_api · 2026-08-19