RX 7900 GRE 混搭十年前的 RX 480,双卡推理提速 36%

tabletuser_blogspot · reddit · 2026-09-08

Reddit 用户在 llama.cpp Vulkan 构建(b10453)下测试 AMD 双卡推理:RX 7900 GRE 16GB 单卡跑不动 20B 以上模型,加入一块老 RX 480 8GB(带宽仅 256 GB/s,单卡生成速度只有 1.8 t/s)后显著提升。

实测结果

结论:即使是带宽差得多的老卡组双 GPU,对 MoE 模型的本地推理收益依然可观。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →