16x GB10 集群成功跑通 Kimi K3,峰值吞吐达 38tps
NVIDIAAI · x · 2026-08-06
开发者成功在 16x GB10 集群上运行完整的 Kimi K3 模型。测试数据显示,平均生成速度超过 20 tokens/s,峰值达到 38 tokens/s,预填充速度为 750 tokens/s。
这是该集群首次配合 dspark 跑通完整的 K3 模型。开发者表示后续将继续进行优化测试,并在准备就绪后发布基于 vllm 的镜像文件和部署指南。
所属事件:16块GB10集群成功跑通Kimi K3,峰值吞吐达38tps(2 条相关)→
「Infra」频道最新
- LightOn 推出一键升级扩容功能,简化模型部署 — IgorCarron · 2026-08-06
- 分布式训练技术逼近临界点,算力成本有望骤降 — markjeffrey · 2026-08-06
- 12GB显存跑MiniMax H3掉速?ComfyUI显存管理问题排查指南 — BrooklynBrawl · 2026-08-06
- Vercel Sandbox 并发配额提升 5 倍,支持 1 万个并发沙箱 — cramforce · 2026-08-06
- 谷歌云 Filestore 引入 Colossus 底层,实现容量与 IOPS 独立扩展 — rseroter · 2026-08-06
- 8x DGX Spark 节点开放世界多智能体实测 — NVIDIAAI · 2026-08-06