求 Qwen 3.8 27B 多种量化版的基准测试对比
Additional-Ordinary2 · reddit · 2026-08-18
用户正在寻找 Qwen 3.8 27B 模型在各种量化方式(如 Q80 至 Q4K)下的统一性能对比数据。特别关注在 MMLU、GSM8K、HumanEval、DeepSwe、MATH 和 BBH 等具体基准测试上的得分,而非单纯的困惑度或 KL 散度指标,希望能找到现成的表格或个人实测数据。
「模型」频道最新
- LatentMDM 新模型算力预算内击败 KV 缓存 AR — msalbergo · 2026-08-18
- Anthropic 内容水印与治理责任的讨论 — asusarla · 2026-08-18
- NVIDIA 发 Nemotron 3.5 Lightning:30B 小 MoE 主打 Agent 执行层 — cwolferesearch · 2026-08-18
- Qwen 3.8 27B 评分飙升,MoE 效率引发热议 — Gear5th · 2026-08-18
- Qwen3.8-27B 免费端点上架 Hugging Face — victor · 2026-08-18
- 斯坦福实测11个LLM:比人类多肯定用户49%,错误行为也近半认可 — uncertain_dev · 2026-08-18