7900 XTX 24GB 能否跑 Qwen,Reddit 征集 ROCm 实测数据
thenomadexplorerlife · reddit · 2026-09-11
一位网友计划组装一台主要用于本地跑 LLM 和 coding agent 的 PC,由于所在地 3090 难买、新 Nvidia 卡太贵,考虑用 7900 XTX 24GB。
他看到不少 3090 + Qwen 的 benchmark,但找不到 7900 XTX 的数据,因此发帖求助:是否有人在这块卡上跑过 Qwen,decode 和 prefill 速度(tok/s)如何,AMD/ROCm 支持情况怎样;另外如果跑 Q4 需要依赖 SSD 流式加载,32GB 系统内存是否够用,还是值得上 64GB。
「Infra」频道最新
- Engram 随机读取不适合 SSD,CPU 内存低延迟共享或成正解 — bookwormengr · 2026-09-11
- 劝退帖:推理工程是真金白银的硬活,八成尝鲜者已悄然放弃 — abhijithneil · 2026-09-11
- Hugging Face《Ultra Scale Playbook》:GPU 集群训练 LLM 的免费技术书 — mdancho84 · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- 推理服务关键指标盘点:流式速度 TPOT 与可用性如何影响体验 — abhijithneil · 2026-09-11
- PlanetScale 推出分片 Postgres,768 台服务器组成 1PB 单库 — dhruv2038 · 2026-09-11