小米开源 MiMo-V2.6:单步 1568 样本Scaling RL 冲击自我改进

XiaomiMiMo · hf · 2026-10-09

小米 MiMo 团队发布全模态模型系列 MiMo-V2.6,核心思路是把 RL 算力作为通向模型自我改进的中央训练范式,并开源训练动态、RL 环境与框架。

要点:

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →