DeepSeek V4-Flash 算力消耗暴降:每 1T tokens 仅需 6.6 万 GPU 时

teortaxesTex · x · 2026-08-01

推文梳理了 DeepSeek 历代模型训练算力消耗的演变:从 V1 的 30 万 H800 GPU 时/1T tokens,降至 V2 的 17.3 万,V3 为 18 万,而最新的 V4-Flash 预计仅需约 6.6 万 GPU 时。

在推理端,V4-Flash 与 V2 的输入输出价格基本持平,但缓存命中成本便宜了 5 倍,速度提升了 3 到 4 倍。这表明当前最强模型的体积和成本已显著低于 26 个月前的版本。

所属事件:DeepSeek历代模型训练算力成本大幅下降(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →