实测:27B 模型塞进 12GB 显存+8GB 内存,仍有约 18 tok/s

bodhi371 · reddit · 2026-10-07

网友 bodhi371 分享了在 12GB 显存 + 8GB 内存上跑 Qwen3.8-27B 的完整方案,实测解码约 18 tok/s、64k 上下文下预填充 500-600 tok/s:

完整构建与运行脚本及数据见 GitHub 仓库 bodhi37/Qwen3.8-27B-12GBVRAM-Recipe。

所属事件:低配硬件实测跑 Qwen3.8 27B:12GB 显存即可胜任(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →