一个驱动开关让 AMD 双卡 Vulkan 推理提速最高 4 倍

tabletuser_blogspot · reddit · 2026-09-28

Reddit 用户在双 Radeon GPU(MI50 16GB + RX 7900 GRE)上跑 llama.cpp Vulkan 后端时发现性能偏低,排查后总结出一套本地推理优化方法:

对用 AMD 卡本地跑大模型的用户,这个开关值得立刻试。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →