不到一块 RTX 6000 的钱装出 768GB 显存,跑通多个大模型
segmond · reddit · 2026-09-18
Reddit 用户 segmond 展示了自己的极限省钱方案:12 张 64GB 的 CMP170HX 矿卡,组成 768GB 显存的推理机,总成本低于一块 RTX 6000 Pro。他用光纤连接另一台机器做 RPC 扩展内存,通过 vLLM 或 llama.cpp 运行 GLM、DeepSeek、Qwen、Kimi、MiniMax 等多个大模型,声称性能远超单卡 RTX 6000 或 Mac Studio。作者长期分享低成本大显存方案,表示算力需求会长期高企,看到好价就应出手。评论区预期会有 API 更便宜、电费噪音等老生常谈的争论。
「Infra」频道最新
- Cloudflare 自曝在造新一代 CI/CD:用 TypeScript 编写管道,公开征集需求 — dinasaur_404 · 2026-09-18
- Hugging Face 缓存大瘦身:v1.32 跨仓库去重,同权重 5 库只占 20GB — victormustar · 2026-09-18
- 传苹果拟用 M8 Ultra 打造 AI 企业服务器,或采用 NVLink Fusion — Beth_Kindig · 2026-09-18
- 云天筱 ProgramAsWeights:英文写 AI 函数,编译后离线跑在 CPU 上 — yuntiandeng · 2026-09-18
- Gary Marcus 嘲讽英伟达上涨:循环经济依然繁荣,暂时 — GaryMarcus · 2026-09-18
- 全球能源危机比想象更严峻,AI与芯片产业难独善其身 — kimmonismus · 2026-09-18