本地模型永远更贵:服务器利用率决定端侧只在模型廉价时普及
kuza55 · x · 2026-09-03
kuza55 在与 GergelyOrosz 的讨论中指出:本地模型已经是事实(手机上已实现),但本地部署永远比云端更贵,因为服务器利用率高得多。所以本地模型只会在你想要的模型本身变得便宜时普及,而不是在模型昂贵时。他还以游戏业类比:云渲染很难满足本地延迟要求,但每款多人游戏都有服务器——大家实际上都在租用云端机器,因为一切都已 SaaS 化。
所属事件:云端算力之争:开发者称本地模型永远更贵(2 条相关)→
「Infra」频道最新
- 奥尔特曼算账:38000 次 ChatGPT 查询用水量才等于一颗加州杏仁 — gaganghotra_ · 2026-09-03
- Reddit 讨论:3090 Ti 本地数字管家选哪款聊天模型 — MarcusAurelius68 · 2026-09-03
- Qwen3.8 Flash 本地实测:Ngram 常开让 token 消耗暴涨 3 倍 — esw123 · 2026-09-03
- Perplexity Computer 在 DGX Spark 上实现全本地运行实机演示 — chrmanning · 2026-09-03
- llama.cpp 弃用 --chat-template-kwargs,推理保留默认开启 — Bulky-Priority6824 · 2026-09-03
- Agentic API:在 vLLM 前加有状态层,把编排从客户端搬进服务端 — techNmak · 2026-09-03