Grok 4.7 在 HLE 榜单仅列第 21,多款模型领跑
据网友贴出的 Humanity's Last Exam(HLE)榜单,xAI 的 Grok 4.7 仅排在第 21 位,与头部模型存在明显差距。榜单前列由 Gemini 3.8、Muse 1.3、GLM-5.3、Qwen 3.8 等模型占据,两条帖子的说法在领跑者上略有出入,但均显示 Grok 4.7 远落后于第一梯队,引发社区对其 benchmark 表现的讨论。
2026-09-22 ~ 2026-09-22 · 2 条相关
- HLE 榜单:Grok 4.7 居第 21,Gemini 3.8 与 Muse 1.3 领跑 — himanshustwts · 2026-09-22
- Grok 4.7 仅列 HLE 第 21,GLM-5.3 与 Qwen 3.8 领跑榜单 — himanshustwts · 2026-09-22