云厂商把闲置 GPU 风险转嫁给客户:按吞吐量预留下单遭吐槽
AAAzzam · x · 2026-09-16
开发者 thdxr 吐槽:目前所有推理服务商(包括大云厂商)都要求客户预留吞吐量(reserve throughput),等于让客户为闲置 GPU 承担风险。他回忆在 AWS 出现之前,你无法按分钟级别大规模租用服务器——如今这种倒退有些令人错愕。
AAAzzam 讽刺地回应:要是有一个「梦幻推理服务商」能让你不用预留吞吐量就能用上 GPU 就好了——点出按需付费的 GPU 推理仍是市场空白。
「Infra」频道最新
- Creative Strategies 看多 Credo:光子芯片+SerDes 垂直整合是增长关键 — BenBajarin · 2026-09-16
- Ocean Protocol 推出按小时计费的专用 GPU 推理服务,H200 低至 2.16 美元/时 — w1kke · 2026-09-16
- Signal65 实测 NVIDIA Vera CPU:agent 任务生命周期比 x86 快 1.64 倍 — ryanshrout · 2026-09-16
- 用 Tailscale 和一个 PWA,AI 智能体在你离开电脑后继续干活 — johnlindquist · 2026-09-16
- DeepSeek V4.1 Flash 跑长 Agent 任务屡屡超时,作者公开详细故障数据 — sebnadeau · 2026-09-16
- 800V DC 成数据中心必然归宿,AI 机柜功率催生供电重构 — BenBajarin · 2026-09-16