Ollama v0.40.0上线:Apple Silicon自动启用MLX运行时
lmoroney · x · 2026-10-07
Ollama v0.40.0 于周二发布,在 Apple Silicon 上,任何 MLX 运行时支持的模型架构都会自动改用 MLX 运行。MLX 是苹果围绕 M 系列芯片统一内存设计的开源机器学习框架。发布说明列出的已支持模型包括 Qwen 3.8、Gemma 4、Qwen 3.6、Qwen 3.5,以及 Nimble、Tev1、Clef、Clef Flash 决策模型和 EmbeddingGemma 2 嵌入模型,团队称会继续测试并启用更多架构。
官方没给速度数据,作者建议自己测:升级前后用 ollama run --verbose 跑同一条常用提示词,对比打印出的 eval rate 即可。
「Infra」频道最新
- Datology 开源 Zephon:确定性流式 dataloader 解决 GPU 数量不一致难题 — josh_wills · 2026-10-07
- 两张老 V100 本地跑 321B GLM-5.3-Flash:开源 Project Maya 实测 40 token/s — lxfater · 2026-10-07
- 数据中心耗水耗电被夸大?铝厂一年用电等于整个波士顿 — csuwildcat · 2026-10-07
- Omarchy Linux 官方推出浏览器远程桌面插件 — juntao · 2026-10-07
- Intel CEO 确认将继续与马斯克 Terafab 合作造芯 — elonmusk · 2026-10-07
- Symmetrix-XL 开源发布:单 GPU 跑千万原子级 MACE 分子模拟 — CatAstro_Piyush · 2026-10-07