Qwen3.8-27B 多模态模型 GGUF 版发布,可本地加速推理
社区开发者 HauhauCS 发布了 Qwen3.8-27B 多模态视觉模型的 GGUF 量化版本,支持图像文本到文本的处理流水线。该版本适配 llama.cpp,并引入 speculative decoding(投机解码)与 FastMTP 技术,可在本地环境实现加速推理,降低了多模态推理任务的部署门槛。
2026-08-17 ~ 2026-08-18 · 2 条相关
- 第 1 集:Qwen3.8-27B 本地实测获赞逼近 Claude Opus(2026-08-15,6 条)
- 第 2 集:阿里开源Qwen3.8-27B多模态模型,Meta发布Muse Code(2026-08-15,4 条)
- 第 3 集:Qwen3.8-27B 去审查衍生模型密集刷屏 Hugging Face 趋势榜(2026-08-15,7 条)
- 第 4 集:Qwen3.8-27B推出INT4与MXFP4量化版本(2026-08-16,2 条)
- 第 5 集:Qwen3.8-27B 多模态模型 GGUF 版发布,可本地加速推理(2026-08-17,2 条)
- Qwen3.8-27B 多模态推理模型发布 GGUF 版 — empero-ai · 2026-08-17
- Qwen3.8 多模态模型发布 GGUF 版本,支持本地加速推理 — HauhauCS · 2026-08-18