Qwen3.6 27B在M5 Max上实现81 TPS本地推理

max_paperclips · x · 2026-07-03

用户转发测试数据显示,在苹果M5 Max芯片上运行Qwen 3.6 27B模型可达81 tokens/秒的推理速度,即使在生成11k token时仍能维持63 TPS。该测试来自MTPLX推理优化工具,其V2版本即将发布,进一步提升本地大模型推理性能。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →