开源引擎 Inco Splash 让 Apple Silicon 大模型推理提速
Inco 发布开源推理引擎 Splash,专为 Apple Silicon 与模型深度优化,内置 DFlash 2 draft 模型,仅需两条命令即可运行。在 M5 Max MacBook Pro 上,该引擎将 Qwen3.8-27B 的推理速度提升至 144 tok/s,为 Mac 用户本地运行大模型提供了高性能方案。
2026-09-19 ~ 2026-09-19 · 2 条相关
- 开源推理引擎 Inco Splash:M5 Max 上 Qwen3.8-27B 跑到 144 tok/s — Lianhuiq · 2026-09-19
- Inco Splash 引擎让 Qwen3.8-27B 在 M5 Max 上跑出 144 tok/s — TheMoonMidas · 2026-09-19