135 美元淘的 MI50 + RX 7900 GRE:19 个 GGUF 模型 Vulkan 跑分
tabletuser_blogspot · reddit · 2026-09-19
作者以约 135 美元购入中国版 MI50(即 Radeon VII,16GB),与 RX 7900 GRE 组成双卡 32GB 显存,用 llama.cpp 的 Ubuntu Vulkan 预编译版(功耗限制 220/190W)跑了 19 个 2035B 级 GGUF 模型的 pp512/tg128 基准。
要点:
- 最快:gpt-oss 20B Q6K(pp512 660 t/s,tg128 84 t/s)
- MoE 模型表现突出:qwen3moe 30B Q6K tg128 约 67 t/s,cohere2moe 30B MXFP4 pp512 504 t/s
- 密集 2731B 模型生成速度明显偏低(gemma4 31B Q6K 仅约 12.6 t/s)
- 完整数据表按模型和参数量两种方式排序,适合低成本双卡推理玩家参考
「Infra」频道最新
- VanEck:NVDA 财报风险在缺电,电力土地头寸基准看涨约 83% — menhguin · 2026-09-19
- 博主用浮点数漏洞挖出 Claude 订阅真实额度:5× 档性价比最高 — RexDouglass · 2026-09-19
- 超大规模云厂商增量资本回报率近 40%,远超 8% 资本成本 — menhguin · 2026-09-19
- 马来西亚数据中心产能主要来自字节跳动,美国在华代建争议引热议 — jwt0625 · 2026-09-19
- Databricks 将 Unity Gateway 引入 Neon,称其为 Kimi K3 最快 AI 网关 — Yuchenj_UW · 2026-09-19
- 本地 Qwen 复刻 Jev 决策:精度持平 96.53%,延迟还更快 — Ok-Development6070 · 2026-09-19