1080Ti+MI50 双卡 Vulkan 跑分:MoE 模型吞吐可超 600 t/s

tabletuser_blogspot · reddit · 2026-09-15

Reddit 用户在 i9 36 核平台(Nvidia GTX 1080 Ti 11GB + AMD Instinct MI50 16GB)上,用 llama.cpp 的 Vulkan 后端(开启 -fa on)实测了 13 个模型的 pp512 与 tg128 速度。

要点:

结论:老卡用户靠 Vulkan 混插小 MoE 模型能获得不错的本地推理体验。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →