实测 Muse Glimmer 30B:编程与写作不及老牌竞品,视觉处理或成亮点
Kahvana · reddit · 2026-08-13
发帖者分享了新模型 Muse Glimmer 30B 的实测体验,并将其与 Gemma 4 31B QAT 和 Qwen3.6 27B 进行了对比。
优点与特性:
- 支持 OpenAI 风格的推理强度切换,推理过程可读性较好。
- 视觉编码器表现优异且尺寸大,工具调用稳定。
- 能够在双卡 RTX 5060 Ti 16GB 上通过 dflash-kquant 跑满 128K BF16 上下文。
短板对比:
- 在日常任务(如搜索、翻译)和自然语言处理上,无法替代 Gemma 4 31B QAT。
- 创意写作能力与一年前的 Mistral Small 3.2 相当。
- 在生产级 .NET 8.0 代码编写上,表现不如 Qwen3.6 27B。
作者推测该模型巨大的图像编码器可能使其在 OCR(光学字符识别)等视觉任务上具备优势,并向社区征集更多最佳使用场景。
「模型」频道最新
- Ollama 确认正开发 Computer use 功能 — reach_vb · 2026-08-13
- 开发者看好 Grok 迭代速度,预测将抢夺 Claude 用户 — XFreeze · 2026-08-13
- AMD 宣布 Day 0 支持 Qwen3.8-2.4T 模型 — AccBalanced · 2026-08-13
- 新模型在 AA 基准测试得 55 分,表现尚可但略逊预期 — teortaxesTex · 2026-08-13
- DeepSeek 新模型在 LM Arena 预测排 41 名 — Unusual_Guidance2095 · 2026-08-13
- Claude Opus 5 登顶推理加速榜,自适应工作负载提速8.9倍 — maksym_andr · 2026-08-13