Reddit 讨论本地跑 K3 的最低成本方案
ylchao · reddit · 2026-07-28
这条 Reddit 讨论的是:如果真想在本地跑 K3,最便宜的可行方案是什么。
帖子列了一串候选方案,包括:DGX Spark / Strix Halo 集群、Optane 持久内存 + GPU、Mac Studio 集群、Orange Pi 6 集群、SSD streaming + GPU、DDR3 + ConnectX-5 RDMA 客户端、两台 DGX Station,甚至 Power10 系统。
它本质上是在讨论大模型本地部署的基础设施成本与可行性。
「Infra」频道最新
- Kimi K3 论文详解注意力残差与分块省内存设计 — suchenzang · 2026-07-28
- vLLM 为 Moonshot 2.8 万亿参数 Kimi K3 上线 day-0 推理支持 — vllm_project · 2026-07-28
- Kimi K3 部署估算:B200 需两节点,B300 可单节点 — HarveenChadha · 2026-07-28
- MLA 机制每百万 token 需 12GB KV,KDA 状态约 230MB — zephyr_z9 · 2026-07-28
- 70B 模型在 AMD R9700 上加载卡住,显存已到 30GB — Developer-Y · 2026-07-28
- Netlify 说 60% 新用户首次部署都走 Drop — thisiskp_ · 2026-07-28