双 RTX 3060 12GB 跑 Qwen3.8-27B 的速度实测
Mean-Ad1493 · reddit · 2026-08-23
计划通过 PCIe 分割线加装第二张 RTX 3060 12GB,使用 layer-split 模式本地运行 Qwen3.8-27B 模型。请求提供真实的 prefill/decode 速度数据以设定预期,强调因预算限制无法升级到 3090。
「Infra」频道最新
- Merge Gateway 上 DeepSeek V4 Flash 限时 75 折 — shensi · 2026-08-24
- Antirez 解释 Speculative Decoding 采样机制 — antirez · 2026-08-24
- Hot Chips 峰会解析:为何当下会出现存储芯片短缺 — firstadopter · 2026-08-24
- Φ-Bench 发布:LLM 能否优化自身基础设施? — 青稞AI · 2026-08-24
- 数据中心被妖魔化?美媒指其十年将创收 270 亿美元 — robleclerc · 2026-08-23
- 如何检查 GPU 内存行重映射健康状态 — StasBekman · 2026-08-23