Reddit 网友为 7900XTX 定制 llama.cpp:27B Q8 跑出 1600tk/s 预填充

nasone32 · reddit · 2026-09-08

一位 Reddit 用户发布了针对 AMD 7900XTX(单卡/双卡)深度优化的 llama.cpp 定制构建,目标是让 Qwen 系列模型在消费级 ROCm 平台上跑出可用速度。

核心成绩:

关键技术点:

作者在 Ubuntu 24 + ROCm 7.14 测试,不提供支持,希望这些补丁最终被上游合并。项目地址:github.com/nasone32/llama.cpp-RDNA3-7900xtx-opt

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →