Qwen 27B 的 NVFP4 量化效果不如预期

Pyrolistical · reddit · 2026-09-01

作者使用 llama-perplexity 对 Qwen3.8 27B 的多个 NVFP4 GGUF 量化模型进行了评测,并与 Unsloth 的基准量化进行对比。结果显示,所有测试的 NVFP4 模型在相同文件大小下的困惑度均高于预期,甚至不如 Q4KXL(作者常用的日常驱动版本)。这解释了为何 Unsloth 未发布 NVFP4 GGUF 版本。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →