llama.cpp 新 PR 补齐 AMD GCN MMQ 配置,MI50/MI60 推理提速

pmttyji · reddit · 2026-09-12

llama.cpp 收到一个针对 ROCm/HIP 后端的 Pull Request(#27841),补上了 AMD GCN 架构缺失的 MMQ 配置。

据提交者说明,该改动对 RDNA2 架构的 MI50、MI60 显卡带来 prompt processing(PP)性能提升,更新的 pp tokens/s 基准数据见 PR 评论区底部。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →