512 块 AMD MI355X 跑出 575 万 tok/s,创 MLPerf 最大规模推理纪录

wkmyrhang · x · 2026-09-17

Crusoe 在 MLPerf Inference v6.1 提交中用 512 块 AMD Instinct MI355X GPU 运行 gpt-oss-120b 和 DeepSeek-R1,吞吐量达 575 万 tokens/s,是 MLPerf 历史上最大规模的 MI355X 推理提交。

三个关键发现:

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →