DeepSeek 曝用 NVIDIA 游戏 GPU 跑推理,10 亿美元预算七成投训练
teortaxesTex · x · 2026-09-24
讨论帖综合了关于 DeepSeek 的几条新信息:约 10 亿美元的算力预算中 70% 用于训练被认为是合理配置。
最引人注意的是一条爆料:DeepSeek 正在用 NVIDIA 游戏 GPU 运行小模型的推理。发帖人认为这是显而易见的妙招——用 Jevon 式小模型或定制版 Qwen 35B 做推理可以大幅提升效率,并表示很期待这个方向。另一条评论还玩味地指出反差:梁文锋说不闭源最强的生产模型,那「最快的」呢?
所属事件:DeepSeek 年化营收破 10 亿美元,拟融 500 亿元并筹备 IPO(7 条相关)→
「Infra」频道最新
- Lightmatter CEO 详谈光互连:激光器搬上 300mm 硅晶圆 — BenBajarin · 2026-09-25
- Oracle回应数据中心不可抗力通知:不等于项目延期 — ns123abc · 2026-09-25
- 100MW+数据中心电力接入要等5-10年,智库呼吁放开自建 — McDonaghMatthew · 2026-09-25
- Scaling 未到墙:从 Kaplan 到多智能体,四代扩展范式接力爆发 — gordic_aleksa · 2026-09-25
- 美银测算:Meta 2027 年自建 5-6GW 算力,斥资 2000 亿美元 — Beth_Kindig · 2026-09-25
- AWS 推出 WhisperX 深度学习容器:词级时间戳加说话人分离一键部署 — AWS ML Blog · 2026-09-25