MiniMax 称 AMD MI355X 在模型 serving 上已接近 B200
hongyangzh · x · 2026-07-24
MiniMax 说 AMD MI355X 在 serving 上已接近 Nvidia B200
这条转发自 MiniMax 的技术帖称,AMD MI355X 在 MiniMax-M3 的推理服务场景里,已经接近 Nvidia B200 的表现。
MiniMax 还发布了两篇技术博客,介绍其 ATOM + ATOMesh 的全栈协同优化,目标对象是一个 428B 的稀疏 MoE 多模态基座模型。
主要技术点
- 使用 EAGLE3 speculative decoding 降低生成延迟
- 引入 MSA-aligned Page-16 KV cache,支持 100 万 超长上下文
- 采用 逐层 FP8 量化,尽量避免视觉模块和 MoE 部分精度下降
- 通过 分布式 P/D 分离架构 支撑大规模集群
整体看,这条信息的价值在于:它展示了 AMD GPU 在真实大模型 serving 里正逐步逼近 Nvidia 的工程实践。
所属事件:MiniMax称AMD MI355X推理性能已接近英伟达B200(2 条相关)→
「Infra」频道最新
- Alphabet 营收增 24%至 1198 亿美元,云业务增 82% — minsuk_chang · 2026-07-24
- Taylor Lorenz:AI 数据中心反弹已失去分寸 — AndyMasley · 2026-07-24
- Vercel 通过构建期预编译,让 Python functions 启动快 2 倍 — cramforce · 2026-07-24
- Google 新增算力不只供云业务,还在喂养搜索和广告 — aronchick · 2026-07-24
- 先进封装才是 AI 芯片供给的关键瓶颈 — Beth_Kindig · 2026-07-24
- Agent 通过 x402 协议实现自助付费取数 — kleffew94 · 2026-07-24