Qwen3.8-27B 多模态模型 GGUF 版发布,可本地加速推理

社区开发者 HauhauCS 发布了 Qwen3.8-27B 多模态视觉模型的 GGUF 量化版本,支持图像文本到文本的处理流水线。该版本适配 llama.cpp,并引入 speculative decoding(投机解码)与 FastMTP 技术,可在本地环境实现加速推理,降低了多模态推理任务的部署门槛。

2026-08-17 ~ 2026-08-18 · 2 条相关

事件全程(共 5 集)→