Google Gemma-4-26B 成功移植 Apple Silicon,显存占用减半
jasonkneen · x · 2026-08-24
开发者展示了 Google Gemma-4-26B-A4B-it 模型在 Apple Silicon (M 系列芯片) 上的成功运行。通过使用 MLX 框架的特定优化版本,模型在加载时占用的显存不到模型大小的一半,并能通过 Shell 进行响应。
「Infra」频道最新
- 小米发布新芯片,宣称支持本地部署 200B 大模型 — lxfater · 2026-08-24
- AI 智能体支付协议之争:x402 领先,Stripe 入局 — MountainAssignment36 · 2026-08-24
- 主权 AI 基础设施缺口达 1.5 万亿,硅谷主导地位终结 — mikeflache · 2026-08-24
- 求助:如何为 Deepseek v4 Flash 集成视觉编码器? — StartupTim · 2026-08-24
- 曝 Mac 本地 Agent 运维方案:合盖不休眠与云端 Mac 集群 — tedddyoweh · 2026-08-24
- Context Layer:用户控制的跨模型/Agent上下文传输协议 — sierracatalina · 2026-08-24