小米 MiMo-V2.6 或是开源界最大规模单次 RL 训练,登顶开源模型

timshi_ai · x · 2026-09-22

罗福利(Luo Fuli)发长文介绍 MiMo-V2.6:按算力计,它很可能是开源模型团队迄今做过的最大规模单次 RL 训练,几十人团队长期专注「scaling up RL」一个目标。模型潜力通过 mid-training 奠定、经大规模 RL 激发,当前位居开源模型第一。

所属事件:小米开源 MiMo-V2.6,登顶开源模型智能指数(23 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →