Muse-Glimmer-30B 新量化方案发布:同显存下精度逼近 BF16
KvAk_AKPlaysYT · reddit · 2026-08-12
一位独立研究者在 Hugging Face 上发布了针对最新模型 Muse-Glimmer-30B 的全新量化版本(GGUF)。作者应用了其最新研究的量化优化技术(包括处于论文待发阶段的技巧和张量映射算法),使得该量化模型在各个 VRAM 显存级别中均未输给其他现有量化方案。
其中表现最突出的是 Q8 量化版本,它不仅体积小于标准的 UD-Q8KXL,而且精度比后者更接近原始的 BF16 权重。作者表示,完整的评测方法、置信区间和评估设置均已公开,后续将发布详细的技术文章解析这些“秘密武器”。
「模型」频道最新
- 曝GPT-5.6 STEM能力超Fable 5,下代模型或重拾写作质感 — haider1 · 2026-08-12
- NVIDIA Nemotron 3.5 Lightning预览版在材料科学RL环境中表现优异 — AllThingsApx · 2026-08-12
- Qwen3.8-Max 法律研究评测不到三月飙升至全球第四 — Alibaba_Qwen · 2026-08-12
- ChatGPT语音模式突发惊悚尖叫,狂喊“NO”后失忆 — Acceptable_Creme4177 · 2026-08-12
- 研究发现 OpenAI 模型思维链频现「外星语言」,推理过程难以监控 — basedjensen · 2026-08-12
- 主流大模型 API 曝漏洞:可提取加密思考过程并泄露密钥 — yangyi · 2026-08-12