Qwen3.8-27B 推出 GGUF 格式,集成推测解码加速

z-lab · hf · 2026-08-23

z-lab 在 Hugging Face 发布了 Qwen3.8-27B 的 GGUF 量化版本。该模型基于 Qwen/Qwen3.8-27B,集成了 DFlash2 技术和推测解码(speculative-decoding)方案,旨在通过使用草稿模型(draft-model)来提升推理速度,兼容 llama.cpp 生态。

所属事件:Qwen3.8-27B 量化版集成推测解码加速推理(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →