放弃租 GPU:一台 121GiB 小主机跑满全家桶本地模型

EAccelerate_42 · x · 2026-09-05

作者宣布停止租用云端 GPU,改用衣柜里两台小盒子(合计 121 GiB 内存 + 48 GB 显存)加一个 iPhone 应用完成全部 AI 需求。本地跑的模型包括 DeepSeek V4 Flash(384K 上下文)、Qwen3.8 27B、GLM-5.3 Flash,图像生成用 Qwen-Image 加编辑,视频用 MiniMax H3。网络层仅通过 Tailscale 私有访问,账单上再无任何 token 计费。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →