DeepSeek 曝用 NVIDIA 游戏 GPU 跑推理,10 亿美元预算七成投训练

teortaxesTex · x · 2026-09-24

讨论帖综合了关于 DeepSeek 的几条新信息:约 10 亿美元的算力预算中 70% 用于训练被认为是合理配置。

最引人注意的是一条爆料:DeepSeek 正在用 NVIDIA 游戏 GPU 运行小模型的推理。发帖人认为这是显而易见的妙招——用 Jevon 式小模型或定制版 Qwen 35B 做推理可以大幅提升效率,并表示很期待这个方向。另一条评论还玩味地指出反差:梁文锋说不闭源最强的生产模型,那「最快的」呢?

所属事件:DeepSeek 年化营收破 10 亿美元,拟融 500 亿元并筹备 IPO(7 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →