业内称华为算力供给不足,800B 模型训练仍很遥远
ShakeelHashim · x · 2026-07-23
转引的核心观点是:中美大模型差距,本质上首先是算力资源差距,而不只是人才或模型能力。
- 这段话估算,要训练一个“和对方一样大”的模型,可能需要约 5 万张 GB300 或华为 950,甚至 20 万张卡。
- 目前资源只够把实验推进到大约 10B active 规模;要训练 800B 模型,离现实仍然很远。
- 文章强调的瓶颈是双重的:一方面卡国内买不到,另一方面资本投入也低于美国。
- 被划重点的一句是:如果要训练 800B,甚至需要 20 万张华为最新卡,而华为自身输出也有限,所以问题“基本无解”。
所属事件:泄露通话稿称 DeepSeek 仅有约两万张算力卡(3 条相关)→
「Infra」频道最新
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11
- 7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据 — thenomadexplorerlife · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- SF Compute 创始人:现在买算力是「绝对糟糕的体验」 — IgorCarron · 2026-09-11
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11