Muse Glimmer 跑分出炉:整体超越 Llama 4,数学代码叫板 Qwen

据 Artificial Analysis 评测,Meta 新开源的 Muse Glimmer 30B 模型智能指数达 35 分,超越 Meta 上一代 Llama 4。该模型在数学、代码逻辑和知识层面表现强劲,在 24 项基准测试中有 12 项获同级最佳,被视为 Qwen3.6-27B 的有力竞争者。尽管在部分综合智能体评估中略显落后,但其工具调用与幻觉控制能力优于同类竞品。

2026-08-10 ~ 2026-08-11 · 4 条相关