Muse Glimmer 跑分出炉:整体超越 Llama 4,数学代码叫板 Qwen
据 Artificial Analysis 评测,Meta 新开源的 Muse Glimmer 30B 模型智能指数达 35 分,超越 Meta 上一代 Llama 4。该模型在数学、代码逻辑和知识层面表现强劲,在 24 项基准测试中有 12 项获同级最佳,被视为 Qwen3.6-27B 的有力竞争者。尽管在部分综合智能体评估中略显落后,但其工具调用与幻觉控制能力优于同类竞品。
2026-08-10 ~ 2026-08-11 · 4 条相关
- Muse Glimmer 评测:30B 模型击败 Qwen 与 Gemma — kimmonismus · 2026-08-10
- Muse Glimmer 智能体评测落后,但工具调用与幻觉控制优于同级 — ArtificialAnlys · 2026-08-11
- Muse Glimmer 评测出炉:得分超 Llama 4 — teortaxesTex · 2026-08-11
- Meta Glimmer 30B 跑分曝光:数学与代码能力叫板 Qwen3.6 — drdanielbender · 2026-08-11