Gemma 4 本地编码实测:后端可用,前端 UI 仍拉胯

curiousily_ · reddit · 2026-07-24

有开发者在搭载 M5 Pro 芯片和 48GB 内存的设备上,使用 OpenCode 对更新后的 Gemma 4(26B A4.0B, Q6 量化版)进行了本地编码实测。

结果显示,该模型在 llama.cpp 服务器上的推理速度约为 60 tokens/s。在实际编码能力方面,它对于后端开发任务表现不错,但在处理 UI/UX 相关代码时表现极差,几乎无法接受。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →