Gemma-4-26B-a4B 传在微调对比中压过 Qwen MoE
JLeonsarmiento · reddit · 2026-07-22
一位 Reddit 用户表示,更新后的 Gemma-4 chat template 玩法让 Gemma-4-26B-a4B 在指令模式和推理效率上压过了 Qwen3.6-MoE 与 Qwen3.5-MoE 的微调版本。
作者称这个结果有些出乎意料,认为对 Google 和本地模型社区都是好消息;但也补充说 Qwen3.6 在 Hermes 里仍然更强,并认为如果有面向 agentic 任务的 Gemma-4.1 微调版本,效果可能会很亮眼。
「模型」频道最新
- DeepSWE评测:Kimi K3达到Claude Fable 5同等能力,成本仅35% — togethercompute · 2026-07-22
- 实测对比:Gemini 3.5 Flash在轻量编程任务中优于GPT-5.6 — Shick_hydro · 2026-07-22
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22
- 教授提醒:最先进的大模型正变得无法相互替代 — emollick · 2026-07-22