Gemma 4 31B 与 Qwen3.8 27B 榜单打架,两家评测结论相反

uncle_leon · reddit · 2026-08-26

Reddit 用户为个人项目选型时发现两个榜单结论完全相反:Artificial Analysis 认为 Qwen3.8 27B 全面领先,而 Arena 榜上 Gemma 4 31B 领先近 20 名、多个类别碾压 Qwen。社区普遍更偏好 Qwen,认为它推理更坚韧,但代价是对简单问题也会过度思考。帖子探讨了不同评测方法(响应速度加权 vs 用户盲测偏好)如何导致排名分歧。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →