Meta Glimmer 30B 跑分曝光:数学与代码能力叫板 Qwen3.6
drdanielbender · x · 2026-08-11
据初步基准测试结果,Meta 新推出的 Muse Glimmer 30B 模型在数学、代码逻辑和知识层面表现强劲,被视为 Qwen3.6-27B 的有力竞争者。
测试者指出,该模型性能显著超越同尺寸的 Gemma4,但目前无法关闭推理/思考模式,并非完全对等比较。尽管如此,其强大能力已足够支撑后续更深入的基准测试。
所属事件:Muse Glimmer 跑分出炉:整体超越 Llama 4,数学代码叫板 Qwen(4 条相关)→
「模型」频道最新
- Hugging Face模型更新:更好支持多角色 — OdinLovis · 2026-08-11
- 探究 Claude 与 GPT 的知识截止日期及预训练时间线 — sshh12 · 2026-08-11
- Grok 4.6 现已在 Cursor 上线 — daniel_mac8 · 2026-08-11
- 文件名带"final_draft"竟拉高评分?LLM审稿被指严重受无关文字干扰 — CShorten30 · 2026-08-11
- 用户实测 Grok 新版:Minecraft 建房测试中代码偷懒问题已修复 — Angaisb_ · 2026-08-11
- 实测 Cursor 中的 Grok:速度与执行力出众,但欠缺创造力 — andrew_n_carr · 2026-08-11