Google Gemma-4-26B 成功移植 Apple Silicon,显存占用减半

jasonkneen · x · 2026-08-24

开发者展示了 Google Gemma-4-26B-A4B-it 模型在 Apple Silicon (M 系列芯片) 上的成功运行。通过使用 MLX 框架的特定优化版本,模型在加载时占用的显存不到模型大小的一半,并能通过 Shell 进行响应。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →