DeepSeek 说更低成本能让它用同样算力训练更大模型
teortaxesTex · x · 2026-07-23
这段引语讲的是 DeepSeek 的成本路线:先把模型做得更便宜,再用同样的算力训练更大的模型。
- 他们认为自己的架构已经在持续向更低成本演进,而且还有很多算法层面的降本空间。
- 核心逻辑是:成本越低,能训练的模型就越大;在同样算力预算下,更高效率就能换来更大规模。
- 配图里的表述还把竞争描述成“份额战”:如果别人只想拿更少的 AI / GDP 份额,反而可能在竞争中占优。
所属事件:DeepSeek 谈研发路线:算法降本、持续学习与克制文化(5 条相关)→
「公司和人」频道最新
- 韩国 VFX 合成师:AI 工具正在撞上封闭 Linux 管线 — Legitimate_Age884 · 2026-07-23
- 前博士生称看过英伟达规模后决定离开学术圈 — Gradientdinner · 2026-07-23
- Supabase 称 AI 编码代理已成数百万应用后端 — ycombinator · 2026-07-23
- 一条帖称 DeepSeek 真正优势在务实与科学 — xiaohu · 2026-07-23
- OpenAI 和 Anthropic 可能会在 AI 商品化中失去护城河 — ctjlewis · 2026-07-23
- 字节被曝在研 Vision Pro 级头显,重量仅为苹果五分之一 — Scobleizer · 2026-07-23