vLLM 联手 Modal 实现 Kimi K3 首日支持部署
vllm_project · x · 2026-07-30
vLLM 官方宣布,Kimi K3 模型发布首日即可在 Modal 平台上通过 vLLM 引擎进行部署。
vLLM 负责提供底层服务引擎,而 Modal 则将其封装为可按需扩展的生产级 API 端点,开发者只需一次部署即可获得完整的模型能力,并能从容应对流量增长。
所属事件:Kimi K3 开源即获 vLLM 与 AMD 首日原生支持(10 条相关)→
「Infra」频道最新
- DigitalOcean 成为 Kimi K3 首发推理伙伴,支持百万上下文 — vllm_project · 2026-07-30
- Kimi K3 上线即支持 AMD 平台,vLLM 实现 Day 0 推理 — vllm_project · 2026-07-30
- 驳斥「DeepSeek与国产光刻机」恐慌论:被夸大的成本与差距 — teortaxesTex · 2026-07-30
- 纯CPU跑通 Kimi K3:自研 Q3 量化占用 1.1TB,速度达 4.2 t/s — Fun-Meaning-6474 · 2026-07-30
- GPT-6将实现自我迭代优化推理算力 — imjustnewatai · 2026-07-30
- vLLM 联合 Baseten 上线 Kimi K3 生产级 API — vllm_project · 2026-07-30