7900 XTX 本地跑模型很快

DynamicWebPaige · x · 2026-07-09

有人在 AMD RX 7900 XTX 上用 ROCm 7.2+ 和 llama.cpp 运行本地模型,实测 Google Gemma 4 26B 可达到 102 tokens/s。 帖子强调这套组合在本地 AI 运行上很“甜点”,重点是驱动、兼容性和实际推理性能。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →