Unsloth 发布 Qwen3.8-27B 量化版:NVFP4 提速 1.5 倍,精度保持 92-97%
danielhanchen · x · 2026-08-14
Unsloth 宣布推出 Qwen3.8-27B 的 NVFP4 和动态 GGUF 量化版本。NVFP4 相比 BF16 速度提升 1.5 倍,同时保留 92-97% 的 top-1% 准确率。UD-IQ2XXS 量化在 9GB 内存下保留 82.5% 准确率,体积比 BF16 减小 83.5%(从 54.7GB 降至约 9GB)。这些量化模型可在 17GB RAM 的本地设备上运行,使 Qwen3.8-27B 成为同尺寸中最强的本地可运行模型。
所属事件:阿里开源Qwen3.8-27B多模态模型登顶HF趋势榜(26 条相关)→
「Infra」频道最新
- X402:谁在为AI代理构建支付层? — Outboxer7979 · 2026-08-15
- AI视频计费按像素面积而非时长,成本核算需核对账单 — DryProgress9179 · 2026-08-15
- DeepSeek-V4-Pro 正式发布:1.6T 参数 MoE,推理成本降至 V3.2 的 27% — AccBalanced · 2026-08-14
- Qwen 3.8-Max 登陆 Modal:2.4T 参数、1M 上下文,配备 DFlash 投机解码 — AAAzzam · 2026-08-14
- Durable Objects 类比 serverless 函数:有状态的对象即服务 — andersonbcdefg · 2026-08-14
- IEA:AI 单任务能耗年降约 10 倍,数据中心用电仍涨 50% — import_jmr · 2026-08-14