DeepSeek为何能低价盈利?模型极小致单芯片吞吐量达Opus的40倍
gaganghotra_ · x · 2026-08-02
针对外界关于 DeepSeek 靠倾销抢占市场的猜测,Jun Song 澄清其低价的核心原因在于模型架构极其精简。
- 体积优势:DeepSeek 的模型大小仅为 Claude Opus 的 1/10、Sonnet 的 1/5,但性能表现依然强劲。
- 算力降本:原本需要 8 张芯片驱动的节点,现在单张芯片即可运行,且推理速度极快。
- 吞吐量飙升:在同等算力下,单芯片可多路复用服务更多用户,其流量处理能力约是 Opus 的 40 倍。
这种以极小模型实现高性能的路线,正是其能在超低定价下依然保持盈利的关键。
「Infra」频道最新
- 仅需 8 美元:成功在 ESP32 芯片上运行 Google Gemma 模型 — DynamicWebPaige · 2026-08-03
- DeepSeek V4 Flash 预填充提速方案:降级 CUDA 至 13.1 — fragment_me · 2026-08-03
- 康奈尔大学发布并行计算与高性能计算学习路线图 — thehiphopswami · 2026-08-03
- 单台 DGX Spark 跑满 DeepSeek V4 Flash 155G:2-bit 量化与 MTP 提速实测 — Puzzleheaded_Base302 · 2026-08-03
- DFlash:基于扩散模型的并行投机解码新框架 — cneuralnetwork · 2026-08-03
- 主流大模型 API 稳定性实测:Anthropic 频繁掉线,Kimi 可用率达 99.4% — weswinder · 2026-08-02