NVIDIA 称 ModelExpress 将 DeepSeek-V4 Pro 启动压到 2 分钟内
NVIDIAAI · x · 2026-07-25
NVIDIA 表示,NVIDIA Dynamo 里的 ModelExpress(MX) 能把 DeepSeek-V4 Pro 的启动时间从 8 分钟降到 2 分钟以内。
- MX 通过 GPU-to-GPU RDMA 传输权重,并复用 kernel cache。
- 它让推理 worker 直接通过 NIXL 从其他 GPU 拉取更新后的权重,避免中心化广播。
- NVIDIA 称这种设计还能同时加速 推理 和 RL 后训练,因为权重传输不再占住关键路径。
所属事件:NVIDIA ModelExpress 将 DeepSeek 启动压至两分钟(2 条相关)→
「Infra」频道最新
- Intel 明年资本开支或超 200 亿美元,14A 进入量产推进 — BenBajarin · 2026-07-25
- GitHub Pull Requests 出现故障,创建 PR 报错 — 0xkarasy · 2026-07-25
- Schmidhuber 祝贺英伟达冲上 4 万亿美元市值 — SchmidhuberAI · 2026-07-25
- Rocket Lab 表示 Neutron 发射产能已开始销售 — BrettKrieger12 · 2026-07-25
- NVIDIA 称用 ModelExpress 将 DeepSeek-V4 Pro 启动压到 2 分钟内 — NVIDIAAI · 2026-07-25
- Hermes Agent 给 Docker 沙箱加了凭证防火墙 — NousResearch · 2026-07-25