Qwen3.8 27B 视觉模型 MLX 量化评测:低比特仍能打
Top-Eye-8104 · reddit · 2026-08-26
团队发布了 Qwen 3.8 27B Vision 模型的多种 MLX 量化版本(从 8bit 到 3.23bpw),并与其他社区版本(如 lm-studio, mlx-community)进行了对比评测。通过在 H200 上使用自建测试集,发现其 11.8 GB 的 DWQ 量化版本在 Top-1 一致性上达到 70.32%,远超同体量的其他版本。该版本可在 16GB MacBook 上运行(需调整 wired limit)。量化方法采用了 BF16 教师模型蒸馏。
「Infra」频道最新
- 阿里发布 Qwen3.8-Flash 预览版,架构升级成本大降 — Alibaba_Qwen · 2026-08-26
- 印度仅占全球总算力 0.2%,算力基础薄弱 — himanshustwts · 2026-08-26
- Linux 基金会庆 35 周年,开源模式剑指 AI — 0xsachi · 2026-08-26
- Facefusion 安卓端开源,视频换脸跑通骁龙 NPU — Few_Caregiver8134 · 2026-08-26
- 苹果新 Mac Studio 官网页面推介 LM Studio 本地模型工具 — mattturck · 2026-08-26
- AI 需求引爆利润,中国封测厂投 150 亿扩产 — pstAsiatech · 2026-08-26