DeepSeek 说更低成本能让它用同样算力训练更大模型
teortaxesTex · x · 2026-07-23
这段引语讲的是 DeepSeek 的成本路线:先把模型做得更便宜,再用同样的算力训练更大的模型。
- 他们认为自己的架构已经在持续向更低成本演进,而且还有很多算法层面的降本空间。
- 核心逻辑是:成本越低,能训练的模型就越大;在同样算力预算下,更高效率就能换来更大规模。
- 配图里的表述还把竞争描述成“份额战”:如果别人只想拿更少的 AI / GDP 份额,反而可能在竞争中占优。
所属事件:DeepSeek 梁文锋投资人会议实录:AGI 路线与算力规划曝光(37 条相关)→
「公司和人」频道最新
- IIT马德拉斯推出 EdTech Tulna AI 教育产品评估标准 — ravi_iitm · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- Anthropic 内部爆料:并非人人都持高 p(doom) 灾难论 — anpaure · 2026-09-11
- AI 电影节 Lumara 将登陆纽约,顶级 AI 电影人齐聚评审 — 0xAllen_ · 2026-09-11
- Anthropic 研究员被指暗中窥探学术客户研究、抢先出成果引争议 — basedjensen · 2026-09-11
- 投资人放话:Palantir×英伟达联手将重创 Anthropic IPO 估值 — pdamodaran · 2026-09-11