76 款 GPU llama.cpp Vulkan 性价比榜:矿卡 P102-100 登顶
tabletuser_blogspot · reddit · 2026-10-09
Reddit 用户基于 llama.cpp 官方 Vulkan benchmark 讨论(#10879,覆盖 76 款 GPU,Llama 2 7B Q40 测试),结合 2026 年二手市场价整理出本地 LLM 推理性价比排名。
核心发现:
- Nvidia P102-100($40-50,320-bit 总线矿卡)以约 1.3 tokens/秒/美元的解码效率登顶绝对性价比之王
- AMD Instinct MI50($110-130)凭借 1TB/s HBM2 带宽成为单位解码成本最优;同显存的 Radeon VII 亦进前三
- 宽总线老旗舰(GTX 1080 Ti 352-bit、RTX 2080 Ti 352-bit)解码常常反超 $300 以下的新卡
- 现代中端卡受 128/192-bit 窄总线瓶颈,tg128 解码吃亏
- Tesla P40 是最便宜的 24GB 入门,但 FP16 疲弱;RTX 4070 Super prefill 极快
结论:Vulkan 后端下,二手大总线/大带宽企业卡与矿卡在性价比上碾压多数现代消费卡,适合预算型 homelab 搭建者参考。
「Infra」频道最新
- Chollet:AI 投入呈超指数增长,产出却仅亚线性回报 — fchollet · 2026-10-09
- FineWeb 作者:用 27B 模型标注预训练数据很疯狂,但通用模型更省部署 — antoine_chaffin · 2026-10-09
- 魔改 MLX 把量化权重暂存到 FP8,M6 prefill 提速 40% — Brilliant-Hall1387 · 2026-10-09
- a16z:Agent 消耗 token 是人类 5 倍,半年增长 14 倍,AWS 为机器用户重构 — a16z · 2026-10-09
- 微软 Surface RTX 开发机砍掉 ConnectX-7 网卡,难以组集群 — Scobleizer · 2026-10-09
- PyTorch 原生支持 AWS Trainium,PyTorch 大会将现场演示 — PyTorch · 2026-10-09