Gemma-4-26B-a4B 传在微调对比中压过 Qwen MoE

JLeonsarmiento · reddit · 2026-07-22

一位 Reddit 用户表示,更新后的 Gemma-4 chat template 玩法让 Gemma-4-26B-a4B 在指令模式和推理效率上压过了 Qwen3.6-MoE 与 Qwen3.5-MoE 的微调版本。

作者称这个结果有些出乎意料,认为对 Google 和本地模型社区都是好消息;但也补充说 Qwen3.6 在 Hermes 里仍然更强,并认为如果有面向 agentic 任务的 Gemma-4.1 微调版本,效果可能会很亮眼。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →