爆料:DeepSeek 正训练 2T 参数模型,8T 也在规划中
Hesamation · x · 2026-09-21
据 Hesamation 转述的爆料,DeepSeek 正在训练一个 2T(万亿)参数规模的模型,并已规划 8T 参数模型。作为参照:Kimi K3 为 2.8T,DeepSeek V4 Pro 为 1.6T。
另据称 DeepSeek 预计华为新款训练芯片将在 2026 年 Q4 至 2027 年 Q1 之间到位,CEO 向投资人表示全面转向国产芯片训练「必须成功」。注意:此为未经官方证实的传闻。
所属事件:爆料称 DeepSeek 训练 2T 参数模型并规划 8T(2 条相关)→
「Infra」频道最新
- Colibrì 推出 Brio 模式:不生成文本,直接给候选答案打分 — Just_Vugg_PolyMCP · 2026-09-21
- Rothschild Redburn 看空 AI 算力,下调 NBIS 与 CRWV 至卖出评级 — JOBhakdi · 2026-09-21
- PC 内存条零售价持续上涨,Meta 的 Muse 仍居 App Store 榜首 — firstadopter · 2026-09-21
- 干细胞成像模型量化实测:W4/W8 混合压缩 6.76 倍零失败 — capicu-ai · 2026-09-21
- CXMT 产能六年扩 10 倍,2026 年底逼近美光水平 — Terminator857 · 2026-09-21
- 双卡 R9700 本地推理踩坑:从 LGA1700 升级 Threadripper 的 PCIe 通道账 — El_90 · 2026-09-21