Qwen 量化实验:探索改进 imatrix 数据集以提升 GGUF 性能
bartowski1182 · x · 2026-08-18
作者 Bartowski 分享了针对 Qwen3.8-27B-GGUF 量化的新 imatrix 数据集实验。文章详细介绍了从纯英文文本转向包含多语言和格式化文本的尝试,并公开了用于生成校准数据的脚本和渲染逻辑。虽然并非“银弹”,但实验结果显示整体性能有所改善,为后续优化提供了经验。
「Infra」频道最新
- Qwen 27B F16 版本运行实测与显存需求 — Blues520 · 2026-08-18
- M2 Ultra 运行 Qwen3.8-27B 速度基准测试实录 — planetearth80 · 2026-08-18
- GitNexus: 知识图谱让编程 Agent 成本减半 — ycombinator · 2026-08-18
- RDNA4显卡启用SageAttention完整指南:RX 9070 XT实测 — eloxH1Z1 · 2026-08-18
- Qwen3.8-27B 推理优化:RTX 3090 跑出 1150 tps — iamMess · 2026-08-18
- RTX 4090 跑 Qwen 2.5 27B:无溢出配置分享 — gavwhittaker · 2026-08-18