Kimi K3 上线即支持 AMD 平台,vLLM 实现 Day 0 推理
vllm_project · x · 2026-07-30
vLLM 官方宣布,Kimi K3 模型在发布首日即原生支持 AMD Instinct 硬件。通过 vLLM 对 ROCm 的适配,开发者在起步阶段就能在 AMD 硬件上高效部署并服务完整的 2.8 万亿参数模型。目前 AMD Instinct 的更广泛性能调优仍在持续推进中。
所属事件:vLLM 首日支持 Kimi K3:8张B300跑满2.8T MoE(11 条相关)→
「Infra」频道最新
- 高盛预测AI Token月处理量到2030年将激增70倍 — Beth_Kindig · 2026-07-30
- 244 GiB 大模型冷启动实测:耗时约 154 秒 — QuixiAI · 2026-07-30
- FP8 统一用于训练与推理解码,RL 端到端提速 16% — joecole · 2026-07-30
- ThunderAgent 引擎实测:吞吐量翻倍,多节点扩展近乎线性 — togethercompute · 2026-07-30
- ICML 2026 论文 ThunderAgent:解决智能体推理 KV 缓存抖动 — togethercompute · 2026-07-30
- QuixiCore-ROCm 开源:专为 AMD MI300x 优化的高性能 Kernel 库 — QuixiAI · 2026-07-30