长文拆解:Nvidia 有护城河但无垄断,Google 自研 TPU 占全球算力近四分之一
AryHHAry · x · 2026-10-06
一篇长文论证「Nvidia 主导 AI 算力」与「Nvidia 控制 deeptech」是两回事:
- 份额与变化:按收入算 Nvidia 占 AI 加速器约 80–90%;按 H100 等效算力单位,份额已从 2024 年初约 90% 降至 2025 年 9 月约 70%,增长主要来自 Google TPU 和 Amazon Trainium。
- 护城河在软件:CUDA 生态、kernel、工程师习惯与迁移成本构成 moat,纸面更便宜的硬件现实中也难胜出。
- 所有权 ≠ 依赖:Google 拥有全球约四分之一的 AI 算力且大部分是自研 TPU;定制 ASIC 增长最快的是推理侧,AMD 补价格空档,Meta 与 Microsoft 自建路线。
- 中国路径:出口管制下,华为昇腾号称已超 Nvidia 国内市场,DeepSeek 订购数十万颗推理芯片;但华为全球算力 2026 年仍不足 Nvidia 产出的 4%,受制 HBM 与制造。
结论:这是供给对称性的破裂——一边仍依赖,另一边在建无法被远程切断的路线,Nvidia 像大质量恒星,引力巨大但辐射压开始抗衡坍缩。
「Infra」频道最新
- 跑了几十小时端到端基准,Strata 推理服务器在完整构建任务上翻车 — julianharris · 2026-10-06
- R9700 32GB 本地跑 i2v 提速难:用户指 Windows 下 ROCm 表现糟糕 — vladomkd · 2026-10-06
- CutBCE:Google JAX TPU 核消除大规模推荐 BCE 训练 OOM,提速 91.9% — _reachsumit · 2026-10-06
- 8-16GB 显存新思路:通用模型编排多个领域专家小模型 — CyberExplore · 2026-10-06
- 纯浏览器跑 37GB Qwen MoE:专家权重从磁盘流式加载,输出对齐 llama.cpp — naklitechie · 2026-10-06
- 4090 跑 Qwen 本地模型,上下文窗口约 32k 就爆显存 — BLUECOW009 · 2026-10-06