Lily 开源上线:把 Qwen 算子直接映射到 Apple 芯片架构

perplexity_ai · x · 2026-09-03

Perplexity 发布 Lily 并开源,其设计理念是把 Apple 芯片当作独立的推理平台,将 Qwen 的算子直接映射到其计算与内存架构上。

GitHub 仓库(pplx-garden/lily,Rust 实现)要点:

发布帖同时汇总了此前串内的跑分:Lily 在 M5 Max 上 prefill 吞吐较 MLX-LM 平均高 1.23 倍、decode 高 1.35 倍。

所属事件:Perplexity 开源 Lily:Apple 芯片专用本地推理引擎(6 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →