Cedana 联手 NVIDIA:单节点托管整套编码模型

Cedana 与 NVIDIA Dynamo 团队发布联合方案,展示在单台 8x B200 节点上托管一整套前沿编码模型组合:由大模型负责长程规划,中型模型处理大多数请求。借助 NVIDIA Dynamo 负责服务编排,模型间切换仅需约 1 分钟,显著降低了部署编码模型的硬件门槛。

2026-10-02 ~ 2026-10-02 · 2 条相关