Perplexity 开源本地推理引擎 Lily,专为 Apple 芯片上的 Qwen3.6 打造
perplexity_ai · x · 2026-09-03
Perplexity 官方宣布开源 Lily,这是其为 Perplexity Computer 的混合计算架构打造的本地推理引擎。
- Lily 专门针对 Apple 芯片上的 Qwen3.6-35B-A3B 优化,确保端侧算力不成为 Computer 任务的瓶颈
- 支持云模型 + Mac 本地模型分工的 hybrid compute 模式
- 代码已发布在 GitHub(pplx-garden/lily)
所属事件:Perplexity 开源 Lily:Apple 芯片上的 Qwen 专用推理引擎(5 条相关)→
「Infra」频道最新
- llama.cpp 弃用 --chat-template-kwargs,推理保留默认开启 — Bulky-Priority6824 · 2026-09-03
- Agentic API:在 vLLM 前加有状态层,把编排从客户端搬进服务端 — techNmak · 2026-09-03
- Google 发布 Gemini 3.8 Flash:干得更多但可能花更多 token — The Verge AI · 2026-09-03
- Mitchell Hashimoto 公开 Superlogical 服务器内存优化实录 — sull · 2026-09-03
- Lily 跑分:M5 Max 上预填吞吐高 MLX-LM 23%,解码高 35% — perplexity_ai · 2026-09-03
- FastH3 实现本地推理:支持 Apple Silicon 与 DGX Spark — Vandy_simp · 2026-09-03