百元内二手 Tesla P100 跑本地大模型:生成速度反超游戏显卡近一倍

Mrinohk · reddit · 2026-09-28

一位本地推理爱好者分享实测:前沿大模型(Claude)曾劝他别买二手 Tesla P100(无 Tensor Core、量化支持差、供电散热麻烦),但他花不到 100 美元买入后,配合 llama.cpp 的社区专用补丁和 --cpu-moe 配置,跑出了远超预期的效果。

关键数据:原配置 RX6600 XT 跑 Qwen3.6 35B A3B(Q4 量化 + MTP):生成速度约 30-35 tok/s(代码 45-50);换 P100 并套用 shinbunbun 的 P100 专用补丁后,生成速度提升到 54-60 tok/s(代码 66-72),上下文 32k。散热用 3D 打印外壳加 94mm 猫头鹰风扇,供电换新电源花费约 100 美元。

他的结论:不要全信前沿模型对预算硬件的判断;P100 是被严重低估的入门本地推理卡,这个价位买不到替代品。他已再购一张,计划组双卡专用推理机。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →