Kimi code CLI 训练细节曝光
eliebakouch · x · 2026-07-14
这条提到一套与 Kimi code cli 相关的训练/推理实现细节:
- 很强调 agent swarm(多智能体协作)。
- 使用 muon optimizer。
- 在 RL 阶段直接训练,之后仍做了一些 post-training,目的是让它在其它 harness 下也能表现良好。
- 还提到用了 MOPD。
- 另外指出 cache hit 成本很低,但如果要在外部 provider 上缓存 linear attention state,会遇到一些问题。
「编程与Agent」频道最新
- Kernel 接入 Stripe Link:浏览器 Agent 一行 API 即可安全付款 — jeff_weinstein · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 3D 网站生成工作流公开:MCP 接 Codex,一句话出可玩游戏 — FellMentKE · 2026-09-11
- 用 GPT-6 Astra 加 Hyper3D MCP 免建模做 3D 落地页 — FellMentKE · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Codex 用户实测:Sol 搭配 Astra/Luna 子代理更省额度 — pvncher · 2026-09-11