Strix Halo 上 ROCm 反超 Vulkan:解码最快 41.9 tok/s,提速 28%-47%

QuixiAI · x · 2026-09-17

Lucebox 团队分享其在 AMD Strix Halo 上把 ROCm 推到超过 Vulkan 后端的成果:同一天、同一台机器、同一 prompt 下,Lucebox 引擎(ROCm)与 llama.cpp(Vulkan)对比。配合 DSpark drafter,Lucebox ROCm 在 8K 上下文解码达 41.9 tok/s,123K 长上下文下 38.0 tok/s,比 llama.cpp/Vulkan v0.7.5 快 28%-47%,prefill 快 17%-47%。作者认为这对所有 Strix Halo(AMD AI Max)本地产推理用户是利好。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →