小米 MiMo v2.6-Flash-RL 对比同量级开源模型,评测图表出炉
ababaka · reddit · 2026-09-22
小米发布 MiMo v2.6-Flash-RL 后,官方模型页缺少与同级开源模型的对比图表。发帖人遂用 Perplexity 将其与相近参数量级的开源权重模型进行横评,并贴出了对比结果。
帖子还附带一张对比图,直观展示了 MiMo v2.6-Flash-RL 相对小尺寸开源模型的表现。这是社区对该新模型实际水平的第一批第三方参照之一,注意数据经由 Perplexity 生成,准确性待官方基准验证。此外小米还发布了基于 Qwen 蒸馏的 MiMo-V2.6-Distill-Qwen-9B。
「模型」频道最新
- 分析称 Kimi 新版小版本升级竟重做全量预训练,采用两阶段训练 — stochasticchasm · 2026-09-22
- OpenAI 模型规范新条目:承认成人模式是值得探索的方向 — borowcy · 2026-09-22
- OpenAI 内部数学模型解题引争议:研究者称学界持续低估其意义 — acoolrandomusername · 2026-09-22
- 小米 MiMo-V2.6-Pro 冲进 Code Arena 前十,开源模型排第三 — arena · 2026-09-22
- 模型续评:伦理项目比时间表更耐久 — LesaunH · 2026-09-22
- Paradigm 开源 Limite 及 Value model,MATH-500 少样本得分 59.8% — tensorqt · 2026-09-22