小米 MiMo-V2.6 直播 RL 训练:每步 20 亿 token,斯坦福 Marin 同步直播预训练

stanfordnlp · x · 2026-09-20

Stanford NLP 账号转发推荐了两个当前最值得关注的公开模型训练实验:

两条直播让外人第一次能像内部成员一样「追更」大模型训练全程。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →