Kimi K3 的 Stable LatentMoE 和 Gated MLA 到底基于哪些论文
Ok_Warning2146 · reddit · 2026-07-21
这条 Reddit 帖子在追问 Kimi K3 号称 SOTA 背后到底用了哪些论文/技术,重点列了四个组件:
- KimiDeltaAttention:来自 Kimi Linear,本质上是更通用的 gated delta net
- AttnRes:Kimi 自己论文里的一个方法
- Stable LatentMoE:帖子猜测它可能基于 Nvidia 的 LatentMoE,再加上 quantile balancing,但想确认对应论文
- Gated MLA:已知 MLA 是 DeepSeek 提出的 KV cache 压缩方法,但这里的“Gated MLA”具体指什么还不清楚
整体上,这是一条在做模型架构“考古”的技术讨论:不是单纯看分数,而是想把 Kimi K3 背后的方法链条拆清楚。
「研究」频道最新
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- 本周热议的数学猜想到底关我什么事?一张普通人视角清单 — koltregaskes · 2026-09-11
- 用果蝇大脑连接组造了个 LLM,作者放出在线 demo — ngxson · 2026-09-11
- 社会学家 Harry Collins:LLM 无法发明新语言,做不了前沿科学 — whoamisri · 2026-09-11
- 「Waymo 效应」:AI 正在悄悄让科研协作变少 — JohnHammersley · 2026-09-11
- HF 工程师争论:非生成任务全用因果注意力是在浪费算力 — antoine_chaffin · 2026-09-11