Kimi K3 的 Stable LatentMoE 和 Gated MLA 到底基于哪些论文
Ok_Warning2146 · reddit · 2026-07-21
这条 Reddit 帖子在追问 Kimi K3 号称 SOTA 背后到底用了哪些论文/技术,重点列了四个组件:
- KimiDeltaAttention:来自 Kimi Linear,本质上是更通用的 gated delta net
- AttnRes:Kimi 自己论文里的一个方法
- Stable LatentMoE:帖子猜测它可能基于 Nvidia 的 LatentMoE,再加上 quantile balancing,但想确认对应论文
- Gated MLA:已知 MLA 是 DeepSeek 提出的 KV cache 压缩方法,但这里的“Gated MLA”具体指什么还不清楚
整体上,这是一条在做模型架构“考古”的技术讨论:不是单纯看分数,而是想把 Kimi K3 背后的方法链条拆清楚。
「研究」频道最新
- OpenAI 认为长程模型要按完整行动序列做安全对齐检查 — rhiever · 2026-07-22
- 有人想训练一个一致性 LoRA,让动漫场景保持统一 — ThirdWorldBoy21 · 2026-07-22
- 图计算工作负载 854.graph500 进入 SPEC CPU 2026 — Prof_DavidBader · 2026-07-22
- BlackboxNLP 2026 因投稿激增招募额外审稿人 — hanjie_chen · 2026-07-22
- AWS 证明自蒸馏推理可在 SFT 中保住推理能力 — AWS ML Blog · 2026-07-22
- UI2App 显示截图还原远落后于真实交互恢复 — Grace Man Chen · 2026-07-22