博主质疑 DeepSeek 用华为芯片训 R2 报道:细节多站不住脚
teortaxesTex · x · 2026-09-25
针对「DeepSeek 曾尝试在华为昇腾上训练 R2」的报道,博主 teortaxesTex 提出多重质疑:
- DeepSeek 大概率从未有独立的「R2」项目——其一贯策略是统一模型线、尽量少维护 checkpoint,DS-R 系列更可能像 DS-Coder 那样分化,而不是在全新技术栈上试水旗舰模型(更合理的是先训个 V3.5-lite 验证)。
- 旁证:智谱曾在昇腾上训练过 9B 的 GLM-Image,但旗舰模型至今仍在 Nvidia 上训练;连更贴近国家任务的智谱都如此谨慎。
- 当时华为最好的 910C 软件支持很差,最近才出现首个在该类硬件上训练的大模型(来自美团)——「美团比 DeepSeek 更擅长 ML」显然不合常理。
他借此回应「华为能否在 2030 年前追上 Nvidia」的问题,认为原帖的关键假设值得推敲:如果中国把 HBM 供应上升为「国家工程」、投入远超预期,结论可能完全不同。
所属事件:博主逐条反驳 DeepSeek 昇腾训 R2 传闻不可信(2 条相关)→
「Infra」频道最新
- 马斯克晒 xAI 算力家底:Colossus 2 将达 110k GB200 加 88 万块 GB300 — ivan_bezdomny · 2026-09-25
- 作者重返 IEEE 演讲:从芯片到模型全栈微优化以小博大 — fooobar · 2026-09-25
- 开发者自建 AI 获客工作流,断言下时代入口属 OS 级硬件 — dotey · 2026-09-25
- WSJ:AI 关键内存芯片价格飙升令美国陷入两难 — pstAsiatech · 2026-09-25
- 实测:Qwen Flash Next IQ4_XS 四项基准全面胜过 27B FP8 — smallDeltaBigEffect · 2026-09-25
- 铌酸锂高速调制器新演示,双波段光栅耦合器设计更亮眼 — jwt0625 · 2026-09-25