Moonshot 发布 2.8T MoE 的 Kimi K3,带 100 万上下文
ricklamers · x · 2026-07-27
Moonshot 官方发布了 Kimi K3,并把它定位为当前最强模型:
- 2.8T MoE 架构
- 原生视觉理解
- 100 万 token 上下文窗口
- 官方称新架构实现了“每单位算力 2.5 倍智能”的提升,而不只是单纯堆参数
除了模型本体,Moonshot 还开放了更多底层栈,包括高性能 attention kernel、MoE 通信库,以及面向大规模 agent 环境的基础设施。转发中的 SGLang 实测显示,K3 在 gsm8k 上达到 423 tok/s,并已准备好 RL 支持;其服务端优化包括 fused KDA decode kernels、DP attention、DSpark、PD disagg 和 KDA-aware prefix caching。
所属事件:Moonshot 发布 Kimi K3 开放权重引争议(155 条相关)→
「Infra」频道最新
- Unsloth Desktop 热修复:Qwen-Image-2.1 支持图像编辑与量化修复 — danielhanchen · 2026-09-23
- 128GB Strix Halo 跑 Qwen3.6 35B-A3B 稳定 50 tok/s,用户问现在最优解是什么 — jankeydankey · 2026-09-23
- Together AI 上线灰度发布:模型升级不停机,分步切流自动回滚 — togethercompute · 2026-09-23
- 专为大规模运行 Agent 的专用硬件亮相 — cyrilzakka · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23
- RTX5090 上 Qwen 27B 跑 24 小时,自主写出完整 Postgres-SpringBoot-React 表格应用 — anglepoiselife · 2026-09-23