Qwen3.8-27B 推出 3.7bpw 量化版,体积缩至 11.7GB
udmrzn · x · 2026-08-17
发布 Qwen3.8-27B-Ridge-3.7bpw 量化模型,将体积压缩至 11.7 GiB。该模型采用非平铺量化策略,状态张量保持 Q80,Gated-DeltaNet 混合器采用 Q4K,并保留了原生 MTP 和完整视觉塔。目前支持在 llama.cpp、Ollama 和 LM Studio 中运行。
「Infra」频道最新
- 英伟达拟投 30 亿美元入股 Lancium,布局 Stargate 园区电力 — Beth_Kindig · 2026-08-17
- Bun 新版 Web API 性能提升最高达 4 倍 — ctjlewis · 2026-08-17
- GLM 5.3 即将登陆 AI Gateway:获 DeepsecBench 最高分 — evilrabbit_ · 2026-08-17
- 红帽:构建生产级AI Agent的可观测性层 — blaizedsouza · 2026-08-17
- Day 81:构建分布式AI流水线与可观测性 — blaizedsouza · 2026-08-17
- LLM 推理优化前置知识:Transformer 演进与分类 — blaizedsouza · 2026-08-17