Qwen 3.8 登 Apple Silicon,社区提速超 150%
gajesh · x · 2026-08-16
MLX 社区针对 Qwen 3.8 27B 模型发起了在 Apple Silicon 上的性能优化挑战。在社区参与下,该模型在 Mac 上的运行速度已较基线提升 151%(解码速度达 53.3 tok/s)。该项目通过 speculative decoding 等技术探索本地大模型的加速极限。
「Infra」频道最新
- Qwen3.8-27B在16GB显存上遭遇KV缓存量化悬崖:q4_0到q4_1性能骤降 — Unnamed-3891 · 2026-08-16
- 新协议压缩 agent 历史 71.9%,欲让树莓派跑 3B 模型 — Parallel_News · 2026-08-16
- 开发者探究 B200 是否存在未文档化加速指令 — SkyLi0n · 2026-08-16
- 从零手写NVFP4内核,GB300上超cuBLAS 4.7% — pranjalssh · 2026-08-16
- a16z:NeoClouds 正复刻铁路转光纤的基础设施剧变 — a16z · 2026-08-16
- OpenAI 预览 GPT-5.6 Sol 超快模式:Cerebras 赋能提速 14 倍 — Justgototheeffinmoon · 2026-08-16