100 美元二手 GPU 搭出 27B 模型推理机,7.39 t/s 跑通
Whole_Alternative_18 · reddit · 2026-08-17
一位 Reddit 用户用约 100 美元购入的两块二手 RX 580 8GB(合计 16GB 显存),搭配旧款 DDR3 工作站主板平台,以 Q3KM 量化跑 Qwen 27B,生成速度约 7.4 t/s(处理速度约 14 t/s)。
作者坦言这套方案体验不佳:速度慢、长上下文输入很痛苦,也不适合 MTP 类模型;但胜在极便宜,甚至比用系统内存跑还省,适合预算极其有限但愿意妥协的人。
「Infra」频道最新
- Qwen 3.8 27B 在 AMD 显卡上推理速度仅 20t/s — soyalemujica · 2026-08-17
- omlx:支持 SSD 缓存的苹果芯推理服务器 — jundot · 2026-08-17
- 开发者开源本地模型编排系统:让 27B 小模型自主选型并产出生产级代码 — Single_Land8080 · 2026-08-17
- 味之素减供 30%,中国 AI 供应链面临大考 — pstAsiatech · 2026-08-17
- Cerebras 推理加速显著:10小时 RL 任务压缩至1小时 — dejavucoder · 2026-08-17
- llmfit 工具:一键扫描硬件并匹配可运行的最优 LLM — mhdfaran · 2026-08-17