质疑 AtomicChat 假冒 Q4 量化实为 Q2

po_stulate · reddit · 2026-09-01

用户发现 AtomicChat 发布的 Qwen3.8-Flash-Next Q4KM 量化模型体积异常小(仅 56GB),经检查其张量主要为 IQ2S 而非标准 Q4K,且 GGUF 元数据也显示为 IQ2S。虽然其模型卡显示高 KLD,但作者质疑这可能是将低精度量化伪装成高精度。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →