Qwen 3.8 27B 在 AMD 显卡上推理速度仅 20t/s
soyalemujica · reddit · 2026-08-17
用户在 AMD 7900XTX 上测试 Qwen 3.8 27B 模型,发现在长上下文(80k+)环境下开启 MTP 后速度依然极低(20-35 t/s)。帖文提供了详细的启动参数,怀疑是架构或量化问题导致速度不如云端方案。
「Infra」频道最新
- LocalAI 团队半年新增 17 个 C++ 推理后端 — rms80 · 2026-08-17
- 黄仁勋:土地电力和机房是 AI 工厂的新战略资源 — firstadopter · 2026-08-17
- 3060 与 4070 Super 混搭本地部署可行性与配置建议 — HsSekhon · 2026-08-17
- 英伟达 15 亿美元注资,确保 OpenAI 获俄亥俄州 8GW 算力 — nvidia · 2026-08-17
- 英伟达将提供算力,OpenAI 租用俄亥俄州 8GW 数据中心 — nvidia · 2026-08-17
- 英伟达担保电力并建厂,OpenAI 锁定 600 亿美元算力至 2030 年 — NVIDIA Blog · 2026-08-17