训练与推理共享算力池但只单向流动:冲刺训练必然挤占线上服务容量
robleclerc · x · 2026-09-26
一篇被广泛认可的算力经济分析指出:训练和推理虽然共享同一个 GPU 舰队,但可互换性是单向的——前沿 post-training 需要互联紧密的完整集群,而推理不需要,因此训练随时可以从线上服务抽走容量,推理却永远无法反向回填训练。
核心论证:
- 如果一场 post-training 是冲刺性质(作者以「gpt-5.6 在 fable 解除商务冻结 8 天后落地」为推断依据),它抽走的必然是已分配给推理服务的容量
- 已排期的训练运行早已从营收计划中划出,不会损失预期收入;但冲刺挤占的是正在产生收入的 serving 容量
- 因此「训练挤占推理」不是中性调度问题,而是直接侵蚀营收的决策
「Infra」频道最新
- 英伟达当年押注 CUDA 支持 AI 研究,被指是击败 AMD 的关键 — moultano · 2026-09-26
- GLiNER2.5-Decide 转换 CoreML:提速约 4 倍、峰值内存省 5 倍 — BLUECOW009 · 2026-09-26
- Bonsai 2 提速挑战赛:Qwen 27B 压缩至 1/10,Mac 端已提速 140% — gajesh · 2026-09-26
- H200 买还是租算清账:60% 利用率两年自有才划算 — recentheartbroken · 2026-09-26
- Lambda CTO 称算力不会大宗商品化,目标 2030 年达 3GW 算力 — TheZachMueller · 2026-09-26
- AI 自动化如何沿供应链重塑铜与电力的长期价格 — r0ck3t23 · 2026-09-26