质疑 AtomicChat 假冒 Q4 量化实为 Q2
po_stulate · reddit · 2026-09-01
用户发现 AtomicChat 发布的 Qwen3.8-Flash-Next Q4KM 量化模型体积异常小(仅 56GB),经检查其张量主要为 IQ2S 而非标准 Q4K,且 GGUF 元数据也显示为 IQ2S。虽然其模型卡显示高 KLD,但作者质疑这可能是将低精度量化伪装成高精度。
「模型」频道最新
- 民间已运行无安全限制 GLM-5.3 模型 — cephaloform · 2026-09-02
- AI 不会“记得”错误,重复使用会导致非实质性精度恶化 — gerardsans · 2026-09-02
- 第三方评测:Grok 4.6 拒绝危险生物查询且不误杀科研 — ns123abc · 2026-09-02
- Anthropic 报告:Claude for Microsoft 365 出现错误率升高 — ClaudeAI-mod-bot · 2026-09-02
- 多模型管道成标配:Gemini 3.7 Flash 充当低成本实时审核员 — DynamicWebPaige · 2026-09-01
- Gemini 3.7 Flash 写代码模拟宝可梦游戏 — DynamicWebPaige · 2026-09-01