曝 DeepSeek 开源高性能内核或为新模型铺路,传有单卡小模型
teortaxesTex · x · 2026-09-30
X 用户 teortaxesTex 分析认为,DeepSeek 不太可能在实现「GEMM 达到硬件上限 99.8%、MegaMoE 达 98%」并开源这些内核之后,却没有训练任何可端到端使用的东西——支持内核发布的意图很可能就是为后训练做准备。
他进一步猜测,传闻中的单 GPU 小模型可能诞生于华为昇腾(Ascend)芯片。该说法目前为个人推测,未获证实。
所属事件:DeepSeek 新模型被曝或用华为昇腾训练(3 条相关)→
「Infra」频道最新
- 量化 softmax 预训练 Transformer:K=16 时验证损失仅增 0.004 nats — illinois · 2026-09-30
- xLLM 训练推理基础设施全套开源,含 xattn 与 xBridges — HongyiWang10 · 2026-09-30
- 120 张 B300 跑自动内核研究循环,6 小时为 Kimi K3 提效 40% — bookwormengr · 2026-09-30
- Cerebras 宣布为 General Compute 提供全球最快推理服务 — beffjezos · 2026-09-30
- 亚洲输美空运货物 8% 是数据中心配件,每天 30 架全货机 — yacineMTB · 2026-09-30
- 2x 4060 8GB 跑 Gemma 26B:mradermacher 量化实现 75 tok/s — Spiritual_Impress_30 · 2026-09-30