小米 MiMo 完成 RL 训练,DeepSWE 从 58.41 跃至 72.57
nrehiew_ · x · 2026-09-21
小米 MiMo 的强化学习训练已完成,MiMo Pro 模型在 DeepSWE 基准上的成绩从 58.41 提升到 72.57。作为参照,DeepSWE 目前最高分为 74,由 Astra、Gemini 3.8 Flash 和 Opus 5 保持,MiMo Pro 已接近第一梯队。
「模型」频道最新
- 判断器刷爆榜单背后:个人 AI 的选项表归属被忽视 — sujingshen · 2026-09-21
- 用户实测:GLM 5.3 表现不如 GLM 5.2 — floriandotorg · 2026-09-21
- Cua 开源 Jev 范式复现:70.6 万参数小模型填表单胜 Jev API — aigclink · 2026-09-21
- 开发者实测:Jev 当模型路由器,或是其杀手级用法 — nicolechirps · 2026-09-21
- 行业共识浮现:Agent harness 将按任务专化,护城河在数据层 — amankhan · 2026-09-21
- Next Token 播客第3期:火线解读 Jev 新范式与 Agent 工作流 — oran_ge · 2026-09-21