Perplexity Mac 推混合模式:本地模型跑子任务
testingcatalog · x · 2026-08-31
Perplexity 即将在 Mac 上推出 Hybrid 混合模式,允许本地模型处理部分子任务以节省算力成本。支持 Gemma 4 (16GB 内存)、Qwen 2.5 32B (32GB 内存) 及 Perplexity 自研模型 (32GB 内存)。云端负责统筹与重推理,本地负责轻量任务。此外新增 Privacy Gate 功能,通过本地小模型检查发往云端的数据是否包含敏感信息,用户可决定是否发送。
所属事件:Perplexity Mac 推混合模式,本地模型分担云端任务(2 条相关)→
「Infra」频道最新
- Qwen3.8 Flash 在双 DGX 上跑出 415 tok/s — NVIDIAAI · 2026-09-01
- 曝 OpenAI 自研芯片 Jalapeno:LLM 推理速度达 1500 tokens/s — firstadopter · 2026-09-01
- TensorSharp 跑 Qwen 3.8 Flash Next 性能实测 — fuzhongkai · 2026-09-01
- 腾讯混元 AngelSlim:Hy4 模型压缩至 214GB 并支持异构协同 — 腾讯混元 · 2026-09-01
- 三星为英伟达改推8层HBM4E,速率要求提高20% — 创业邦 · 2026-09-01
- 为何 Llama.cpp 中增大上下文反而提升了推理速度? — satnl · 2026-09-01