Qwen 3 30B本地推理破千,Apple端侧AI硬件优势凸显

StefanoGogioso · x · 2026-08-11

一位研究者分享了使用 Qwen3-30B-A3B 微调模型在 Apple M5 Max 笔记本上的运行体验。在批处理下,推理速度可达 1000+ tokens/秒,使许多一年前无法想象的本地工作流成为可能。他称赞 Apple 在消费级本地智能硬件领域处于绝对领先地位,并构筑了极深的护城河。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →