NVIDIA ModelExpress 将 DeepSeek 启动压至两分钟
NVIDIA 宣布借助 Dynamo 框架中的 ModelExpress 技术,成功将 DeepSeek-V4 Pro 模型的启动时间从 8 分钟大幅压缩至 2 分钟以内。其核心技术路径是通过 GPU 到 GPU 的 RDMA 直连,以最快速度将庞大的模型权重直接送入显存,从而显著提升大模型的部署与启动效率。
2026-07-25 ~ 2026-07-25 · 2 条相关
- NVIDIA 称用 ModelExpress 将 DeepSeek-V4 Pro 启动压到 2 分钟内 — NVIDIAAI · 2026-07-25
另有 1 条近重复转述:NVIDIAAI