百元内二手 Tesla P100 跑本地大模型:生成速度反超游戏显卡近一倍
Mrinohk · reddit · 2026-09-28
一位本地推理爱好者分享实测:前沿大模型(Claude)曾劝他别买二手 Tesla P100(无 Tensor Core、量化支持差、供电散热麻烦),但他花不到 100 美元买入后,配合 llama.cpp 的社区专用补丁和 --cpu-moe 配置,跑出了远超预期的效果。
关键数据:原配置 RX6600 XT 跑 Qwen3.6 35B A3B(Q4 量化 + MTP):生成速度约 30-35 tok/s(代码 45-50);换 P100 并套用 shinbunbun 的 P100 专用补丁后,生成速度提升到 54-60 tok/s(代码 66-72),上下文 32k。散热用 3D 打印外壳加 94mm 猫头鹰风扇,供电换新电源花费约 100 美元。
他的结论:不要全信前沿模型对预算硬件的判断;P100 是被严重低估的入门本地推理卡,这个价位买不到替代品。他已再购一张,计划组双卡专用推理机。
「Infra」频道最新
- AI 不说自然语言只说 PTX?内核自动优化思路引热议 — teortaxesTex · 2026-09-28
- TrendForce 预测 2030 年全球数据中心电力缺口达 268GW — Beth_Kindig · 2026-09-28
- 算力股暴涨:戴尔年内涨338%,美光涨267%,英特尔涨226% — firstadopter · 2026-09-28
- 英伟达拟每季向中国供 50 万块 RTX Pro 5500,字节订单要两个季度才能交付 — pstAsiatech · 2026-09-28
- Nvidia 吐槽出口管制过时,称中国芯片厂 2022 年来空前增长 — pstAsiatech · 2026-09-28
- 从 16GB 到 128GB:一路升级本地 AI 硬件的经验 — TheOyinbooke · 2026-09-28