Qwen3.8 27b 在 M5 Max 128GB 上跑分实测

julianharris · x · 2026-08-16

用户在配备 128GB 内存的 M5 Max 上测试了 Qwen 3.8 27B 模型(bf16,262k 上下文)。使用 oMLX + opencode 栈,bf16 精度下速度为 8t/s,8bit 量化下达到 17t/s。测试显示 CPU 节流明显,用户期待未来 4bit 量化和推测解码能进一步提升速度。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →