DeepSeek 曾在昇腾上训 R2?圈内人逐条反驳称传闻不可信
NunoSempere · x · 2026-09-25
针对「DeepSeek 曾尝试在华为昇腾上训练 R2 模型」的报道,teortaxesTex 提出系统性质疑,认为这是以讹传讹的传言:
- 他 90% 确定从未存在过 "R2" 项目——DeepSeek 一直倾向统一模型线、尽量少出 checkpoint,DS-R 注定会像独立 DS-Coder 一样被合并
- 为什么要在全新硬件栈上试旗舰模型,而不是拿 V3.5-lite 这类小模型先试?智谱虽在昇腾上训过 9B 的 GLM-Image,但旗舰仍用英伟达
- 当时最好的华为硬件是 910C,硬件差、软件支持糟糕;近期唯一在同类硬件上训出大模型的是美团——难道美团 ML 能力比 DeepSeek 强?
- NunoSempere 回应:即便如此,"DeepSeek 没在华为芯片上训练"这一结论仍然成立,但此事更多反映 Epoch 的证据标准问题
所属事件:博主逐条反驳 DeepSeek 昇腾训 R2 传闻不可信(2 条相关)→
「Infra」频道最新
- 曝 AI 芯片创企 DensityAI 拟融资数亿美元,估值 100 亿美元 — steph_palazzolo · 2026-09-25
- 曝 xAI 三个月内点亮 66 万张 GB300,年底 GPU 总量达 144 万 — ns123abc · 2026-09-25
- Epoch AI 图表:同等智能水平 AI 价格持续跳水,降幅超其他技术 — jeff_weinstein · 2026-09-25
- 多智能体通信催生新基建:Agent 间的「全局总线」会是下一个原语 — madhavsinghal_ · 2026-09-25
- 投资人预言:3-5 年内芯片到 PCB 设计将融合成一条连续流 — ai · 2026-09-25
- 高通 2nm 骁龙8至尊版发布:CPU 首破 5GHz,全线为智能体重写架构 — 量子位 · 2026-09-25