DeepSeek v4.1 Flash 发布首日即适配 vLLM,覆盖六款 NVIDIA GPU
woosuk_k · x · 2026-09-12
SemiAnalysis 指出,DeepSeek v4.1 Flash 在发布当天( Day 0)即可在 NVIDIA vLLM 上开箱即用,零改动跑通 H100、H200、B200、B300、GB200、GB300 全部六款 GPU SKU,称赞 NVIDIA 与 Inferact 团队的工作效率。作为对比,AMD 的 vLLM 支持尚未跟上,在该模型上仍无法正常运行,后续帖中会展开细节。这条推文也侧面反映了发布方与推理栈协作的成熟度:模型 Day 0 兼容已成头部团队的基本功,而 AMD 生态的响应速度仍是短板。
「Infra」频道最新
- 全球廉价电力争夺战:AI 数据中心该建在哪,训练与推理答案不同 — pravchaw · 2026-09-12
- 用股权融资买算力本末倒置,风投圈提议发明「硬件收入衍生品」 — ns123abc · 2026-09-12
- Relace 单日处理 1 万亿 token,占 DeepSeek v4 Flash 37% 流量 — stuffyokodraws · 2026-09-12
- Yutori 浏览器 agent 单任务成本 1.46 美元,不到前沿模型 1/10 — DhruvBatra_ · 2026-09-12
- 编译器自动推导 FlashAttention:含 SMEM 与 Tensor Core 分配 — vtabbott_ · 2026-09-12
- 算力决定 AI 进度:若十年前爆发,现有硬件红利将一次性兑现 — cis_female · 2026-09-12