QUASAR 发布全量化 NVFP4 Qwen3.8-27B,性能接近 BF16

arty_photography · reddit · 2026-08-26

QUASAR 团队发布了全量化 NVFP4 版本的 Qwen3.8-27B,使用量化感知蒸馏(QAD)训练,模型大小从 55.6GB 降至 19.7GB,在 GPQA-Diamond 和 AIME26 上性能接近原始 BF16 模型,优于其他 NVFP4 量化版本。支持 vLLM 和 Blackwell GPU。论文已发布。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →