Ollama v0.40.0上线:Apple Silicon自动启用MLX运行时

lmoroney · x · 2026-10-07

Ollama v0.40.0 于周二发布,在 Apple Silicon 上,任何 MLX 运行时支持的模型架构都会自动改用 MLX 运行。MLX 是苹果围绕 M 系列芯片统一内存设计的开源机器学习框架。发布说明列出的已支持模型包括 Qwen 3.8、Gemma 4、Qwen 3.6、Qwen 3.5,以及 Nimble、Tev1、Clef、Clef Flash 决策模型和 EmbeddingGemma 2 嵌入模型,团队称会继续测试并启用更多架构。

官方没给速度数据,作者建议自己测:升级前后用 ollama run --verbose 跑同一条常用提示词,对比打印出的 eval rate 即可。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →