AMD MI355X 跑 Kimi K3 吞吐量达 952 tok/s,性能美元比碾压 B200
AnushElangovan · x · 2026-08-02
工程师成功在 AMD MI355X 芯片节点上运行 Kimi K3 模型,实现了极高的推理效率。
- 节点聚合吞吐量:达 952 tok/s/node
- 单流解码速度:达 118 tok/s
- 竞品对比:聚合吞吐量是英伟达 B200 的 3.8 倍,单流解码速度是其 1.3 倍。
- 性价比:在 tok/s/$ 指标上(48 对 33)击败了英伟达 B300。
所属事件:AMD MI355X运行Kimi K3实现吞吐量大涨与成本大降(3 条相关)→
「Infra」频道最新
- AMD 入局开源大模型:发布 Instella-MoE-16B 推理模型 — airesearch12 · 2026-08-03
- 美国多州拟取消数据中心税收优惠,AI算力成本或面临上升 — pstAsiatech · 2026-08-03
- 低显存跑视频模型太慢?开发者探讨 HuggingFace Pro 订阅的性价比 — Smooth-Telephone9443 · 2026-08-03
- AI 离线推理怎么做?开发者热议批量任务的最佳工程实践 — cmm324 · 2026-08-03
- AI 工程师必看:LLM 推理部署与优化 10 周实战路线图 — _jaydeepkarale · 2026-08-03
- 应用开发者应自研端侧模型:将算力下放给用户 — abacaj · 2026-08-03