AI 模型定价拆成电力、GPU 租赁与利润,硬件分成变大
davidmanheim · x · 2026-07-27
模型服务商的 token 定价,被拆成三部分:电力成本、硬件折旧/租 GPU 成本,以及利润率。
这条讨论的核心是:电价相对稳定,而硬件与算力租赁成本更容易成为价格波动的主因,所以 AI 公司每多赚一美元,分给硬件相关环节的比例反而会更高。
- 硬件供应商天然希望成本结构里“硬件占大头”
- 当算力供给紧张时,价格并不是由“最高价值用途”决定,而是更像由“第二高价值用途”定价
- 这本质上是在讨论 AI 产业链里算力稀缺如何重塑利润分配
所属事件:AI推理服务被指比自租GPU贵数十倍(4 条相关)→
「Infra」频道最新
- Nebius 推出本地 relay,把四种编程 Agent 接到开放模型 — HowDevelop · 2026-07-28
- GLM-5.2 已能在戴尔工作站本地跑到 40 tokens/s — pcuenq · 2026-07-28
- 黎曼流形上的二阶泰勒展开与 Hessian 定义 — FrnkNlsn · 2026-07-28
- Advantest 前景要看 Teradyne、TSMC 和 AI 测试链 — tengyanAI · 2026-07-28
- Teradyne 电话会将验证 AI 测试需求是否仍吃紧 — tengyanAI · 2026-07-28
- 铟磷化合物短缺加剧,VCSEL 扩产成关键变量 — zephyr_z9 · 2026-07-28