开源项目 MLX.fast 宣称 Apple Silicon 小模型推理最高提速 3 倍

VagabondTruffle · reddit · 2026-09-27

开发者发布开源项目 ishizuki,基于 MLX 优化 Apple Silicon 上的本地推理,宣称可让 Qwen3.8+Flash-Next 等小型模型在苹果芯片上最高提速 3 倍。作者曾在 MLX.fast 排行榜登顶,并称在 M5 以下芯片上仍是目前最优实现,欢迎社区贡献进一步优化。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →