7900 XTX 本地跑模型很快
DynamicWebPaige · x · 2026-07-09
有人在 AMD RX 7900 XTX 上用 ROCm 7.2+ 和 llama.cpp 运行本地模型,实测 Google Gemma 4 26B 可达到 102 tokens/s。 帖子强调这套组合在本地 AI 运行上很“甜点”,重点是驱动、兼容性和实际推理性能。
「Infra」频道最新
- NVIDIA 用 RTX PRO 和 DGX 推本地 AI agents — nvidia · 2026-07-21
- NVIDIA 称 HGX B300 机密推理开销低于 8% — BenBajarin · 2026-07-21
- AWS DeepRacer 新增自定义系统引导和开发者模式 — AWS ML Blog · 2026-07-21
- docbank 发布本地优先文档系统,面向人类和智能体 — tdhopper · 2026-07-21
- NVIDIA 推出 Cosmos 3 Edge 与 DGX Station 开放 agent 栈 — nvidia · 2026-07-21
- 黄仁勋东京会见日本半导体高层 — nvidia · 2026-07-21