小米 MiMo 完成 RL 训练,DeepSWE 从 58.41 跃至 72.57

nrehiew_ · x · 2026-09-21

小米 MiMo 的强化学习训练已完成,MiMo Pro 模型在 DeepSWE 基准上的成绩从 58.41 提升到 72.57。作为参照,DeepSWE 目前最高分为 74,由 Astra、Gemini 3.8 Flash 和 Opus 5 保持,MiMo Pro 已接近第一梯队。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →