llama.cpp 基准显示 ROCm 与 Vulkan 在 AMD R9700 上互有胜负

Gesha24 · reddit · 2026-07-28

一位用户在 AMD Radeon AI PRO R9700 上对 ROCm 7.14 和 Vulkan 版 llama.cpp 做了详细基准对比,结果并没有出现简单粗暴的“谁一定更快”。

帖子把硬件、编译参数和模型都列得很完整,测试了 E4B-Q4、Gemma 31B Q4、Qwen 27B Q6 等模型。在短上下文场景里,ROCm 在部分 prompt processing 上更快,但 Vulkan 在另一些模型和生成指标上反超;在长上下文测试里,双方优势又会随模型和指标切换。

结论是:在这类 RDNA4 本地推理场景里,后端选择会显著影响吞吐,但优势并不是一边倒,而是取决于模型大小和上下文模式。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →