曝 Moonshot 艰难预训练新基座,DeepSeek 算力自主成关键优势

teortaxesTex · x · 2026-09-11

X 用户 teortaxesTex 分析:Moonshot(Kimi)正在做 K3 的 RL 训练,但再次微调旧的 MLA 基座(K2.7,本质是 2025 年 7 月的 K2),暗示其预训练新基座存在困难,对阿里云算力依赖过重。相比之下,DeepSeek 因自有算力(梁文锋的执行能力),能快速推出 V4s 和 V4.1,验证了「算力自主权」对模型迭代速度的重要性。

所属事件:传 Kimi K2.8 仅为 K2 后训练版,Moonshot 新基座预训练遇阻(2 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →