SGL 推出 Qwen3.8-27B NVFP4 检查点,BF16 表头显著提效
EAccelerate_42 · x · 2026-08-25
SGL 项目为 Qwen3.8-27B 模型新增了 NVFP4 检查点,特别将 lmhead 保留为 BF16 精度。测试显示,在 FP8 KV Cache 基础上配合 BF16 lmhead,能显著提升模型精度,适合对准确率要求更高的场景。项目已同步更新 Cookbook 文档。
「模型」频道最新
- Inherent 发布 27B 参数 Faraday Agent,复现研究超 GPT-4 — emmanuelvivier · 2026-08-25
- 神秘模型 Ox Alpha 登陆 OpenRouter,引发开发者圈猜测 — emmanuelvivier · 2026-08-25
- 网友实测:Minimax H3 用中文提问效果大幅提升,英文提示词或拖后腿 — apoke890 · 2026-08-25
- 疑似 Gemini 3.8 Flash 提前泄露,网友称谷歌兑现小模型更新承诺 — Last_Conclusion_8984 · 2026-08-25
- 只训练投影器即可扩展新模态,Llama 能力不退化 — rohanpaul_ai · 2026-08-25
- 只改一个词结果大不同,用户实测 AI 回答存性别偏差 — RecordingThis6802 · 2026-08-25