双 7900XTX 跑 Qwen 3.8 仅 11 token/秒,网友求解性能之谜

Nota_ReAlperson · reddit · 2026-09-05

作者用两张 AMD 7900XTX 加 128GB DDR4 内存在最新 llama.cpp 上运行 Qwen 3.8 Next,仅得到约 11 token/秒的速度,远低于其他用户在单卡 3090 或 9700XT 上的表现,发帖求助性能排查建议。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →