lithos-metal 内核在 M5 上实测快于 Ollama,作者称深度调优 M5 Max

JiaZhihao · x · 2026-10-09

作者 JiaZhihao 确认其开源 megakernels 项目 lithos-metal 目前针对 M5 Max 深度调优,正在为 M5 Pro 优化。用户实测在 M5 Pro 上运行 Qwen3 27B 时,预热后 lithos 明显快于 Ollama,但也指出推理速度与服务体验是两个问题:其实际工作流(本地语音输入法,固定 5.6K token 系统提示、每轮仅 15-90 输出 token、贪心解码)更在乎首字延迟与模型保温/闲置卸载,而非长文吞吐,Ollama 在功能层面仍有优势。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →