SGL 推出 Qwen3.8-27B NVFP4 检查点,BF16 表头显著提效

EAccelerate_42 · x · 2026-08-25

SGL 项目为 Qwen3.8-27B 模型新增了 NVFP4 检查点,特别将 lmhead 保留为 BF16 精度。测试显示,在 FP8 KV Cache 基础上配合 BF16 lmhead,能显著提升模型精度,适合对准确率要求更高的场景。项目已同步更新 Cookbook 文档。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →