Qwen3.8-27B 推出 3.7bpw 量化版,体积缩至 11.7GB

udmrzn · x · 2026-08-17

发布 Qwen3.8-27B-Ridge-3.7bpw 量化模型,将体积压缩至 11.7 GiB。该模型采用非平铺量化策略,状态张量保持 Q80,Gated-DeltaNet 混合器采用 Q4K,并保留了原生 MTP 和完整视觉塔。目前支持在 llama.cpp、Ollama 和 LM Studio 中运行。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →