iPad 外接 AMD R9700 跑 Qwen 27B 达 159 tok/s
TheOriginalG2 · reddit · 2026-10-09
LemonSeed Studio 展示了在 iPad Pro 上通过雷雳外接盒接入 AMD Radeon AI PRO R9700、本地运行 Qwen3.8-27B Q4(131k 上下文)的方案,实测速度亮眼:
- 解码速度(基线 / MTP=3 / DFlash2,tok/s):R9700 在 iPadOS 31.2/108.7/158.5,macOS 与 Linux 成绩几乎一致,Strix Halo 上最高 64.4
- Prefill(4K tokens):R9700 约 1,600+,Strix Halo 仅 517
- 技术要点:iPadOS 侧嵌入未修改的 Linux amdgpu/amdkfd 驱动作为 PCIDriverKit 扩展;LSE 引擎跨 Linux/macOS/iPadOS 统一,记录前向计算图、算子融合并按设备实测选最快内核;推测解码按实测接受率与成本动态选择草稿树
- 0.5.8 新增 DFlash2 草稿树默认开启、Strix Halo prefill/decode 优化、lse-server 模型拉取等
提供 OpenAI 兼容 server、CLI 与 C 库,全部开源。
「Infra」频道最新
- lithos-metal 内核在 M5 上实测快于 Ollama,作者称深度调优 M5 Max — JiaZhihao · 2026-10-09
- 3000 万参数模型跑在 Postgres 里,召回率媲美 0.6B 嵌入模型 — bdsqlsz · 2026-10-09
- Kimi K3 与 DeepSeek V4.1 在 NVIDIA NIM 上频繁超时,其他模型正常 — Professional_Log1367 · 2026-10-09
- 开发者发现 vLLM 可传入 input embeds,猜想微调 token 被严重低估 — cephaloform · 2026-10-09
- Kevin Kwok 长文:TSMC 如何靠抽象 warfare 造出自己的市场 — kevinakwok · 2026-10-09
- 极客级隐私栈:searxng 藏在 67 层代理链后仅走 tailnet — haydendevs · 2026-10-09