开源模型横评:Gemma 31B 性能超越 DeepSeek V4 与 Qwen

Afinetheorem · x · 2026-09-02

针对文本分类任务的实际测试显示,Google 的 Gemma 31B 在表现上轻松击败了 DeepSeek V4 Flash 和 Qwen 3.5 122B,且体积更小、速度更快。作者进一步指出,在自建的视觉+逻辑基准测试和上下文逻辑测试中,Gemma 31B 均表现优异,而 Qwen 3.5 27B 在 60 多个测试模型中表现最差,引发了关于部分中国模型在特定任务上“Benchmark 过拟合”的讨论。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →