Qwen3.8 多模态模型发布 GGUF 版本,支持本地加速推理
HauhauCS · hf · 2026-08-18
HauhauCS 发布了 Qwen3.8-27B 的 GGUF 版本,该模型属于多模态视觉模型,支持 speculative decoding(投机解码)和 FastMTP 技术。GGUF 格式使其便于在本地硬件上运行,适合资源受限环境下的高效率推理任务。
所属事件:Qwen3.8-27B 多模态模型 GGUF 版发布,可本地加速推理(2 条相关)→
「模型」频道最新
- Karpathy 预测 LLM 终极形态:端侧推理、工具调用与微调槽位 — cephaloform · 2026-08-18
- Grok 又翻车:给用户生成离谱「注视建议」遭吐槽 — moultano · 2026-08-18
- Sakana Namazu 模型登陆 Vercel AI Gateway — SakanaAILabs · 2026-08-18
- Claude 读取 Markdown 文件离谱翻车 — yoobinray · 2026-08-18
- Ling-3.0-flash MXFP4 量化 GGUF 发布,自带 MTP 还有 heretic 变体 — pmttyji · 2026-08-18
- MoE 模型高并发时会退化为加载全部权重吗? — LocalLLaMa_reader · 2026-08-18