SemiAnalysis:预训练算力占比将从67%骤降至7%,后训练与推理成主角
FinanceYF5 · x · 2026-09-17
SemiAnalysis 估算,OpenAI 与 Anthropic 的算力分配正在剧烈反转:预训练占比将从 67% 降至 7%,后训练与 RL 从 5% 升至 55%,推理达 38%。
同文分析 HBM 走向:下一代加速器将从 12-hi 堆叠转向 8-hi 成为标准(Nvidia Rubin Ultra 即从每 GPU 288GB 降至 192GB),供应链一度预期冲 16-hi 的趋势正在逆转。
对内存带宽最敏感的推理场景,4-hi HBM 提供最优的 $/带宽即最低每 token 成本;超过一定阈值后,HBM 容量的边际收益递减,而每个 bit 的 BOM 成本不变。主要实验室的 ASIC 硬件团队计划从下一代 HBM4 起采用该方案。下一轮硬件竞争的关键不只是算力,而是内存带宽。
所属事件:SemiAnalysis:预训练算力占比将从67%骤降至7%(2 条相关)→
「Infra」频道最新
- 腾讯开源 FlexKV 分布式 KV 缓存:TTFT 最高降 70%,吞吐提升 16% — Roger_M_Taylor · 2026-09-17
- NVIDIA 上架 DeepSeek-V4.1-Flash NVFP4 量化版,MIT 协议开源 — TheZachMueller · 2026-09-17
- Bittensor 挖矿优化被 vLLM 收编,Qwen3 吞吐提升约 4% — const_reborn · 2026-09-17
- vLLM 出现 DiffusionGemma 结构化生成 PR,单机 DGX Spark 延迟亮眼 — generativist · 2026-09-17
- 新推理引擎 Atlas 亮相,实测称在 Strix Halo 上超越 llama.cpp — einthecorgi2 · 2026-09-17
- 实战:让 vLLM Prefix Cache 在 Agent 多轮间保持命中 — bolts98 · 2026-09-17