Qwen 27B 的 NVFP4 量化效果不如预期
Pyrolistical · reddit · 2026-09-01
作者使用 llama-perplexity 对 Qwen3.8 27B 的多个 NVFP4 GGUF 量化模型进行了评测,并与 Unsloth 的基准量化进行对比。结果显示,所有测试的 NVFP4 模型在相同文件大小下的困惑度均高于预期,甚至不如 Q4KXL(作者常用的日常驱动版本)。这解释了为何 Unsloth 未发布 NVFP4 GGUF 版本。
「模型」频道最新
- Arena 榜单:Qwen3.8-Max-0902 编程成绩超越 Claude Opus 5 — yogthos · 2026-09-03
- 无视觉能力的 GLM 5.3 把图片转 ASCII 画来读图,工程味拉满 — _AndrewZhao · 2026-09-03
- Gemini 3.8 Flash 实战艾尔登法环:通关 Radahn boss 战,视角操控仍欠火候 — No-Elderberry-7785 · 2026-09-03
- Sebastian Raschka 拆解 The Information 的 OpenAI Astra「循环Transformer」传闻 — rasbt · 2026-09-03
- Gemini 3.8 Flash、Muse Spark 1.3 接连现身,DeepSWE 被碾压 — zainhas · 2026-09-03
- Qwen3.8-Flash-Next 本地量化版频现「幻觉式报错」:坚称上下文已损坏 — arkham00 · 2026-09-03