在 Intel NPU/iGPU 上运行 Phi-4 Mini 的实测
Ecstatic-Wash-7667 · reddit · 2026-08-22
作者分享了在 Intel iGPU/NPU 上部署 Phi-4 Mini 的经验。模型在 NPU 上的运行速度对于上下文压缩来说太慢,但作者发现它适合用于特定资源受限的任务,例如分析 Dozzle 日志(识别真实错误而非噪音,并汇总给更高阶的 Agent)。
主要问题:
- Phi 在 iGPU 或 NPU 上速度较慢(Token Generation 速度慢)。
- 难以找到适合该硬件限制的具体应用场景(不需要 TTS/STT)。
作者正在寻求更多适合在低算力 NPU 上运行的小模型用例建议。
「Infra」频道最新
- Lium 接入 250 台 Mac 组网,已服务 45 亿 Token — markjeffrey · 2026-08-22
- 75 亿美元买“电表”?Stripe 收购 OpenRouter 的 IT 视角解读 — sanjaykalra · 2026-08-22
- X 平台上线二度回复控制,利用二进制熔丝过滤提速 — lemire · 2026-08-22
- Nvidia DGX Station 塔式 PC 确认售价 10 万美元 — firstadopter · 2026-08-22
- 美多地出台数据中心禁令,Big Tech 扩建遭批 — deanwball · 2026-08-22
- x402 协议用一行代码取代千个 API,开启链上代理支付 — 0xJeff · 2026-08-22