Unsloth 发布 Qwen3.8-27B 量化版:NVFP4 提速 1.5 倍,精度保持 92-97%

danielhanchen · x · 2026-08-14

Unsloth 宣布推出 Qwen3.8-27B 的 NVFP4 和动态 GGUF 量化版本。NVFP4 相比 BF16 速度提升 1.5 倍,同时保留 92-97% 的 top-1% 准确率。UD-IQ2XXS 量化在 9GB 内存下保留 82.5% 准确率,体积比 BF16 减小 83.5%(从 54.7GB 降至约 9GB)。这些量化模型可在 17GB RAM 的本地设备上运行,使 Qwen3.8-27B 成为同尺寸中最强的本地可运行模型。

所属事件:阿里开源Qwen3.8-27B多模态模型登顶HF趋势榜(26 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →