曝 Moonshot 艰难预训练新基座,DeepSeek 算力自主成关键优势
teortaxesTex · x · 2026-09-11
X 用户 teortaxesTex 分析:Moonshot(Kimi)正在做 K3 的 RL 训练,但再次微调旧的 MLA 基座(K2.7,本质是 2025 年 7 月的 K2),暗示其预训练新基座存在困难,对阿里云算力依赖过重。相比之下,DeepSeek 因自有算力(梁文锋的执行能力),能快速推出 V4s 和 V4.1,验证了「算力自主权」对模型迭代速度的重要性。
所属事件:传 Kimi K2.8 仅为 K2 后训练版,Moonshot 新基座预训练遇阻(2 条相关)→
「公司和人」频道最新
- Thursdai 播客本周预告:Devin 团队新模型、Lyria 2.5 等一周要闻 — thursdai_pod · 2026-09-11
- ThursdAI 周报:Cognition SWE-2 逼近前沿,安全周刷屏与 Navier-Stokes 争议 — thursdai_pod · 2026-09-11
- 百万粉网球网红用 Lovable 自建活动平台,全球办赛 — damienghader · 2026-09-11
- NSF 新设 AI×Bio 交叉博士后奖学金,欢迎申请者加入进化+AI 课题组 — pastramimachine · 2026-09-11
- ThursdAI 9 月 10 日上线:DeepSeek V4.1 Flash 与千禧年数学声明 — thursdai_pod · 2026-09-11
- 语音明星 pyannote 上月模型下载 500 万,招来新任 DevRel 负责人 — paw_lean · 2026-09-11