挑战赛让 Qwen 3.8 在 Mac 上提速 152%
gajesh · x · 2026-08-16
MLX.fast 发起的 Qwen MLX 挑战赛取得突破,展示了 Apple Silicon 在运行密集模型上的潜力。
优化成果
- 目前最佳成绩使 Qwen 3.8 27B 在 Mac 上的推理速度比基线提升了 152.5%。
- 解码速度达到 53.7 tokens/s,比原生多 token 预测(MTP)速度快 2.5 倍。
技术细节
- 推测解码是密集模型优化的关键,挑战者通过优化草稿头权重实现加速。
- 评分机制改进为 8 个隐藏长度的中位数,避免过拟合单一用例。
- 这一成果打破了“Mac 不适合跑密集模型”的普遍认知。
所属事件:MLX 社区挑战赛让 Qwen 3.8 在 Mac 提速超 150%(2 条相关)→
「Infra」频道最新
- Qwen3.8-27B Abliterated 登陆苹果芯片 MLX — SumitGup · 2026-08-16
- RTX 4060 Ti 8GB 能否运行 MiniMax-H3 视频生成? — Mystvearn_ · 2026-08-16
- 4090 本地跑 Qwen 27B:近100 token/s — cocktailpeanut · 2026-08-16
- 传 Nvidia 拟投 30 亿美元,助 OpenAI 锁定俄州数据中心 — rohanpaul_ai · 2026-08-16
- Seeed 推出 reComputer RK3576 边缘 AI 模块 — ___Mufasaa · 2026-08-16
- Agent 容量规划指南:避免生产环境算力惊魂 — blaizedsouza · 2026-08-16