端侧与单卡部署实测:Gemma 4 与 Qwen3.8 谁更实用?

lmoroney · x · 2026-08-25

文章探讨了在不同本地硬件环境下实际可运行的 AI 模型选择。在手机和树莓派等端侧设备上,Gemma 4 凭借 Apache 2.0 许可及多尺寸参数(E2B/E4B/26B MoE/12B 多模态),依然是教学与离线部署的实用首选,文中还给出了其在 Pi 5 上的具体吞吐与内存数据。对于配备 24-32GB 显存的桌面端,Meta 的 Muse Glimmer(约 30B,专注工具调用与截图理解)和阿里发布的 Qwen3.8-27B(27B 多模态,支持 26.2万上下文)显著提升了本地 Agent 的能力上限,使得在消费级 GPU 上运行复杂 Agent 成为可能。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →