2.8T 参数模型推理成本骤降:AMD MI355X 每百万 token 仅需 $1.75

scaling01 · x · 2026-07-31

开发者针对 2.8T 参数模型的推理成本进行了估算。根据推演,Luminal 在未来几个月内有望在 AMD MI355X 上实现 $1.75 / 百万输出 token 的极低成本,在 B300 上的成本则为 $2.92。尽管目前仍处于推算和测试编译阶段,但这预示着超大型模型的推理经济账正在迅速改善。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →