RTX A2000 运行 Qwen 3.8:求最佳量化配置

MrMrsPotts · reddit · 2026-08-22

用户在 12GB 显存和 32GB 内存的配置下(RTX A2000),尝试了 qwen3.8-27b-ud-q4km 模型,速度约为 6 tokens/sec。面对众多量化选项,用户寻求在保证较好编码质量前提下获得更优速度的配置建议。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →