SDXL 微调模型跑进 iPhone 神经引擎:6-bit、8 步、纯离线生图
NovaDevCodeStudio · reddit · 2026-09-08
开发者把 SDXL 微调模型 Juggernaut XL Lightning 转成 Core ML,在 iPhone/iPad 的神经引擎上实现纯本地生图:768x768、8 步采样、6-bit palettized、split-einsum,模型约 3 GB 一次性下载,需 6 GB 以上内存,全程离线(飞行模式实测),另跑通 InstructPix2Pix 图生图和 Real-ESRGAN 放大到 4096。
作者分享了两条踩坑经验:
- Core ML 即使 6-bit 也无法为 SDXL UNet 构建完整执行计划,需手动拆成两块;
- Lightning 在 8 步下用 DPM++ 时 guidance 需调到约 1.5,默认采样器出噪点。
作者还在征集反馈:768 分辨率够不够(1024 显著拖慢)、3 GB 一次性下载是否可接受、iOS 首次为神经引擎编译约两分钟是否算劝退点。
「Infra」频道最新
- 自研 CPU 推理引擎跑 Qwen3.5 0.8B:比 llama.cpp 快 2.9 倍 prefill — Danmoreng · 2026-09-08
- 韩国拟向全民免费开放无限量 AI,推理将成为公共基础设施 — AccBalanced · 2026-09-08
- 「朋友别用 Ollama」:一篇挑刺本地推理默认配置的争议文 — rm-rf-rm · 2026-09-08
- Merge Gateway token 用量一个月暴涨 37.8 倍 — shensi · 2026-09-08
- exllamav3 CPU offload 实测:Qwen 预填快 3.2 倍解码快 2 倍 — Lowkey_LokiSN · 2026-09-08
- TrendForce:英伟达 NVL72 机架 2027 年出货量同比增超 50% — Beth_Kindig · 2026-09-08