QUASAR 发布全量化 NVFP4 Qwen3.8-27B,性能接近 BF16
arty_photography · reddit · 2026-08-26
QUASAR 团队发布了全量化 NVFP4 版本的 Qwen3.8-27B,使用量化感知蒸馏(QAD)训练,模型大小从 55.6GB 降至 19.7GB,在 GPQA-Diamond 和 AIME26 上性能接近原始 BF16 模型,优于其他 NVFP4 量化版本。支持 vLLM 和 Blackwell GPU。论文已发布。
「模型」频道最新
- Nvidia 或提供算力支持 GLM 5.3 免费开放 — bindureddy · 2026-08-26
- 微调谬误:模型饱和后成本比质量更重要 — rhythmrg · 2026-08-26
- sanoTTS:140 万参数模型在 $3 芯片上实时运行 — kastnerkyle · 2026-08-26
- 本周新模型盘点:视觉编码器与机器人基础模型 — TheTuringPost · 2026-08-26
- 用户反馈:复杂任务下 Sol Max 比 Sol Ultra 更可靠 — imjustnewatai · 2026-08-26
- 用户反映 GPT 对话标题莫名变成中文,引发猜测 — rodrigoinfloripa · 2026-08-26