Mac SSH环境下Metal失效致推理降速,需重置GUI域
arthurcolle · x · 2026-08-16
在 Mac 上通过纯 SSH 启动 llama-server 时,尽管 Metal dylib 存在,但模型推理速度仅 5 tok/s。
问题原因:
通过无 GUI 会话的 SSH 启动进程时,Metal 无法访问 GPU 设备,导致回退到仅 CPU 模式运行(日志显示 Metal init 为 0,线程数为 8)。LM Studio 之所以能正常工作,是因为它在已登录的 GUI 会话中运行。
解决方案:
使用 launchctl 在 GUI 域中重新启动 llama-server,确保其获取 Metal 上下文和 GPU 加速能力。
「Infra」频道最新
- CoreWeave 营收增速超 AWS:云算力市场竞争新态势 — abhiadesai · 2026-08-16
- DDR4内存成南亚科技印钞机,旧内存利润超新内存 — zephyr_z9 · 2026-08-16
- 反对数据中心禁令:监管具体危害而非全盘封杀 — QuintinPope5 · 2026-08-16
- 比起订阅服务,我更想买实体硬件自建数据中心 — arthurcolle · 2026-08-16
- RX 6700XT 是否获官方 ROCm 支持?用户实测 ComfyUI 正常 — Aromatic-Lie-7056 · 2026-08-16
- Helium浏览器新功能:拆分TLS ClientHello以绕过审查,寻求反馈 — uwukko · 2026-08-16