Qwen 3.6 35b 在 7900XTX 上跑分反不如 3060Ti?用户排查 Vulkan 配置

Jebbyk1 · reddit · 2026-08-25

一位用户发现 Qwen 3.6 35b (a3b q4-k-m) 模型在 AMD 7900XTX 上的推理速度(20t/s,100% 占用)竟然低于 NVIDIA 3060Ti(30t/s,50% 占用),且在 Linux llama.cpp 环境下使用 Vulkan 和 ROCm 均未能解决性能倒挂问题。用户对此表示困惑,因为理论上 7900XTX 应快 2-3 倍。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →