小米发布 MiMo-V2.6,开源阵营冲进 Code Arena 前十
arena · x · 2026-09-22
小米 MiMo-V2.6 系列(Pro & Flash)发布
- 两款全模态模型,通过大规模强化学习训练,权重、技术报告、RL 环境与训练代码全部开源(MIT 协议)
- 官方宣称 Pro 在多数 agent 基准上比肩 Claude Opus 5 与 GPT-5.6 Sol,Artificial Analysis 智能指数 46 分,为开源模型最高
- 在 Code Arena: WebDev 上以 1628 分(AutoEval)首秀约第 10 名,开源权重中约第 3,仅落后 Kimi K3 Max 46 分、Qwen3.8 Flash Next 7 分;较上代 MiMo-V2.5-Pro 暴涨 153 分(1475→1628),与 Claude Fable 5 (High) 打平
- 注意:目前是早期 AutoEval 分数(基于 Arena 人类偏好数据训练的奖励模型自动投票),随真人投票增多分数仍会变动
所属事件:小米开源 MiMo-V2.6 双模型,登顶开源智能指数(18 条相关)→
「模型」频道最新
- DFlash2 搭配 GLM 5.3 Flash 处理超长 prompt 会出问题 — TheZachMueller · 2026-09-22
- 「MiMo 首创大规模 MOPD」:圈内热议 MiMo-V2.6 向 DeepSeek 叫板 — teortaxesTex · 2026-09-22
- 数字母测试翻车不冤:Jev 逐字母输入 strawberry 时 168/168 全对 — BLUECOW009 · 2026-09-22
- MiMo-V2.6 疑为开源界最大单次 RL 训练,罗福莉称难度超 DeepSeek R1 — teortaxesTex · 2026-09-22
- 博主自纠:落地 SF 发现真正惊喜是 MiMo-2.6,胜过 Grok 4.7 且更便宜 — kimmonismus · 2026-09-22
- cHHillee 力挺 Tinker:托管训练也能拥有自己的 post-training 代码 — cHHillee · 2026-09-22