小米发布 MiMo-V2.6 论文:用强化学习规模化冲击 LLM 核心

KyeGomezB · x · 2026-09-27

Xiaomi 团队发布论文 MiMo-V2.6: Scaling Reinforcement Learning Towards LLM-Core,主张将强化学习规模化作为提升 LLM 核心能力的关键路径。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →