Kimi K3 首日原生支持 vLLM 与 AMD,2.8T 参数可跑在 Instinct
vllm_project · x · 2026-07-30
vLLM 项目宣布,Kimi K3 模型在发布首日即原生支持 vLLM 和 AMD ROCm 生态。
这意味着开发团队可以直接在 AMD Instinct 系列硬件上,开箱部署完整的 2.8T 参数模型。此外,针对 Instinct 硬件的更广泛性能优化工作目前也在积极推进中。
所属事件:Kimi K3发布首日即原生支持vLLM与AMD(2 条相关)→
「Infra」频道最新
- Cognition 实验室访谈:强化学习与推理优化正走向融合 — AAAzzam · 2026-07-30
- Vector Institute 拆解 MoE:4-bit 量化与 Flash Attention 2 部署实践 — VectorInst · 2026-07-30
- 云GPU部署LTX视频模型踩坑记:附自动化安装方案 — Humble_Cut6799 · 2026-07-30
- NVIDIA 预计将 RTX GPU 价格再上调最高 30% — ANR2ME · 2026-07-30
- 端侧模型新思路:牺牲10%精度换取15倍能效提升 — JLeonsarmiento · 2026-07-30
- 云营收增长大比拼:谷歌云 Q1 增速 63% 远超亚马逊微软 — Beth_Kindig · 2026-07-30