Mac SSH环境下Metal失效致推理降速,需重置GUI域

arthurcolle · x · 2026-08-16

在 Mac 上通过纯 SSH 启动 llama-server 时,尽管 Metal dylib 存在,但模型推理速度仅 5 tok/s。

问题原因:

通过无 GUI 会话的 SSH 启动进程时,Metal 无法访问 GPU 设备,导致回退到仅 CPU 模式运行(日志显示 Metal init 为 0,线程数为 8)。LM Studio 之所以能正常工作,是因为它在已登录的 GUI 会话中运行。

解决方案:

使用 launchctl 在 GUI 域中重新启动 llama-server,确保其获取 Metal 上下文和 GPU 加速能力。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →