Artificial Analysis 榜单引争议:Gemma 4 编程能力真比 Qwen 强?

Informal-Trouble2183 · reddit · 2026-08-06

Reddit 网友发现,在 Artificial Analysis 的 SciCode 评测中,Gemma 4 的得分排名高于 Qwen3.6 27b。这引发了关于模型实际编程能力与跑分成绩不符的讨论,社区质疑是 Gemma 4 真的表现优异,还是该基准测试本身存在问题。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →