Cedana 联手 NVIDIA:单节点托管整套编码模型
Cedana 与 NVIDIA Dynamo 团队发布联合方案,展示在单台 8x B200 节点上托管一整套前沿编码模型组合:由大模型负责长程规划,中型模型处理大多数请求。借助 NVIDIA Dynamo 负责服务编排,模型间切换仅需约 1 分钟,显著降低了部署编码模型的硬件门槛。
2026-10-02 ~ 2026-10-02 · 2 条相关
- Cedana 联手 NVIDIA:单台 8×B200 节点托管整套编码模型组合 — josh_wills · 2026-10-02
- 单节点跑下整套编码模型组合:8x B200 上切换模型只需约 1 分钟 — josh_wills · 2026-10-02