放弃租 GPU:一台 121GiB 小主机跑满全家桶本地模型
EAccelerate_42 · x · 2026-09-05
作者宣布停止租用云端 GPU,改用衣柜里两台小盒子(合计 121 GiB 内存 + 48 GB 显存)加一个 iPhone 应用完成全部 AI 需求。本地跑的模型包括 DeepSeek V4 Flash(384K 上下文)、Qwen3.8 27B、GLM-5.3 Flash,图像生成用 Qwen-Image 加编辑,视频用 MiniMax H3。网络层仅通过 Tailscale 私有访问,账单上再无任何 token 计费。
「Infra」频道最新
- 黄仁勋:1GW 数据中心成本 500-600 亿美元,本十年要建 100GW — victor_explore · 2026-09-05
- AMD Strix Halo 跑 Qwen3.8 27B:作者开源完整优化方案 — ilintar · 2026-09-05
- 开源无头浏览器 Lightpanda:比 Chrome 快 11 倍、省 9 倍内存 — JafarNajafov · 2026-09-05
- 腾讯混元 Hy4 预览版:770B 参数、1M 上下文、Apache 2.0 开源 — Aiden_Tech_Ai · 2026-09-05
- 十亿美元单模型训练预言提前兑现,NVIDIA 预测也失准 — IgorCarron · 2026-09-05
- 用阁楼旧硬件起步本地 AI:3 台 NUC + 3700X 怎么组最划算 — -markusb- · 2026-09-05