Kimi K3 与 GLM-5.2 据称将开放挖矿,80 张 5090 跑通
const_reborn · x · 2026-07-28
GLM-5.2 和 Kimi K3 据称很快就会开放“Mining”。
被引用的帖子给出了一个很具体的部署样本:Kimi K3 的完整开权重版本跑在 80 张 RTX 5090 上,单流 20 tok/s,而且是未调优的 day-one 结果。另一个数字是 GLM-5.2 在同一套机器上,上一周把吞吐从 30 tok/s 提到 110 tok/s,后续还会继续提升。
这条信息的重点不是“又来了个模型”,而是它强调了不依赖 HBM 的前沿推理路径:只用 GDDR7 游戏卡 + 普通以太网 + 官方 MXFP4 权重,让实验室、创业公司和高校都能直接拥有、分析、微调并部署 agent。
所属事件:Kimi K3 2.8T参数模型在80张RTX 5090上零HBM运行(8 条相关)→
「Infra」频道最新
- Unsloth Desktop 热修复:Qwen-Image-2.1 支持图像编辑与量化修复 — danielhanchen · 2026-09-23
- 128GB Strix Halo 跑 Qwen3.6 35B-A3B 稳定 50 tok/s,用户问现在最优解是什么 — jankeydankey · 2026-09-23
- Together AI 上线灰度发布:模型升级不停机,分步切流自动回滚 — togethercompute · 2026-09-23
- 专为大规模运行 Agent 的专用硬件亮相 — cyrilzakka · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23
- RTX5090 上 Qwen 27B 跑 24 小时,自主写出完整 Postgres-SpringBoot-React 表格应用 — anglepoiselife · 2026-09-23