AMD MI355X跑Kimi K3达952 tok/s/节点,性能超B200
AnushElangovan · x · 2026-08-02
据@gpusteve,其团队在AMD MI355X上运行Kimi K3,实现每节点952 tok/s的聚合吞吐,单流118 tok/s。相比NVIDIA B200,聚合吞吐提升3.8倍,单流解码提升1.3倍;每美元性能达48 tok/s,优于B300的33 tok/s。
所属事件:AMD MI355X运行Kimi K3实现吞吐量大涨与成本大降(3 条相关)→
「Infra」频道最新
- AMD 入局开源大模型:发布 Instella-MoE-16B 推理模型 — airesearch12 · 2026-08-03
- 美国多州拟取消数据中心税收优惠,AI算力成本或面临上升 — pstAsiatech · 2026-08-03
- 低显存跑视频模型太慢?开发者探讨 HuggingFace Pro 订阅的性价比 — Smooth-Telephone9443 · 2026-08-03
- AI 离线推理怎么做?开发者热议批量任务的最佳工程实践 — cmm324 · 2026-08-03
- AI 工程师必看:LLM 推理部署与优化 10 周实战路线图 — _jaydeepkarale · 2026-08-03
- 应用开发者应自研端侧模型:将算力下放给用户 — abacaj · 2026-08-03